{"as_of":"2026-08-22T08:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b42b1da956927b6570fdaf39317250aefeb8f3552de2d85d662a8229317d7cc","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":36,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:40:25.678637Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2408.07666","last_updated":"2025-12-31T04:06:49Z","snapshot_observed_at":"2026-08-07T23:28:24.025478Z","submitted_at":"2024-08-14T16:58:48Z","title":"Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities","version":5},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-17T22:16:04.386706Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2408.07666"},"observation_digest":"sha256:289399f67f5fbd90e14b0d82bf7450f46b3190c81d9b5174a5a43b066ed9e5e9","observation_id":"39110611-042f-42c9-af23-7ec419afcd0c","resolution":{"observed_at":"2026-05-17T22:16:04.654294Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-12T21:14:04.968477Z","title":"Arcee’s MergeKit: A Toolkit for Merging Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09012","last_updated":"2025-04-23T02:34:59Z","snapshot_observed_at":"2026-08-16T07:36:17.507971Z","submitted_at":"2024-11-13T20:36:02Z","title":"AstroMLab 3: Achieving GPT-4o Level Performance in Astronomy with a Specialized 8B-Parameter Large Language Model","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T21:14:04.968477Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2411.09012"},"observation_digest":"sha256:932208fae80401f2c0f45087a00dd7fcb64ca00df88c7e2b283cfa60f7599fe0","observation_id":"c943feff-4c45-47f0-8394-aa0c91fcbd8f","resolution":{"observed_at":"2026-08-12T21:14:04.968477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-12T11:25:31.738281Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18280","last_updated":"2024-11-27T12:15:22Z","snapshot_observed_at":"2026-08-13T14:51:43.520002Z","submitted_at":"2024-11-27T12:15:22Z","title":"Neutralizing Backdoors through Information Conflicts for Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:25:31.738281Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2411.18280"},"observation_digest":"sha256:7658510fd0e29b59e05656ad47e05aa38b5948de62a7bd23b876ad20f90f69f0","observation_id":"06db0671-0c72-406e-8cc5-c05f2eeb4cb2","resolution":{"observed_at":"2026-08-12T11:25:31.738281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-11T23:11:07.244151Z","title":"Arcee’s mergekit: A toolkit for merging large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02775","last_updated":"2024-12-03T19:17:18Z","snapshot_observed_at":"2026-08-19T15:25:04.942331Z","submitted_at":"2024-12-03T19:17:18Z","title":"Optimizing Large Language Models for Turkish: New Methodologies in Corpus Selection and Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:11:07.244151Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2412.02775"},"observation_digest":"sha256:ddbe9d2620f49bd4ccdd49ee07306f2fcc7ff3f9a0f2987344234f05e863ec32","observation_id":"10f653ad-879e-42a6-b987-a12d412b65d9","resolution":{"observed_at":"2026-08-11T23:11:07.244151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-11T19:24:43.051280Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06712","last_updated":"2024-12-09T18:01:13Z","snapshot_observed_at":"2026-08-19T04:15:00.429910Z","submitted_at":"2024-12-09T18:01:13Z","title":"How to Merge Your Multimodal Models Over Time?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T19:24:43.051280Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2412.06712"},"observation_digest":"sha256:15d8688c106629d2b236d0ac3d2ef91c9da9f92658c77739b7512fca16e4c811","observation_id":"004d3528-d5eb-4744-b92b-77cc6e4465f3","resolution":{"observed_at":"2026-08-11T19:24:43.051280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-11T15:35:55.309162Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10893","last_updated":"2024-12-14T16:49:52Z","snapshot_observed_at":"2026-08-19T16:48:23.461183Z","submitted_at":"2024-12-14T16:49:52Z","title":"BgGPT 1.0: Extending English-centric LLMs to other languages","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T15:35:55.309162Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2412.10893"},"observation_digest":"sha256:900870f325a7aa17d1ec02db5df6b157d196eec36c12619d599b41ca977cfaed","observation_id":"51318e9d-ea98-4fa2-90cf-4cbc2796891d","resolution":{"observed_at":"2026-08-11T15:35:55.309162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-11T12:40:16.070755Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15283","last_updated":"2024-12-18T16:07:44Z","snapshot_observed_at":"2026-08-15T15:00:21.498650Z","submitted_at":"2024-12-18T16:07:44Z","title":"Channel Merging: Preserving Specialization for Merged Experts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T12:40:16.070755Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2412.15283"},"observation_digest":"sha256:30a175f7fb0964dd20d74969cad63f8e2986f867edb53761bc56da12bae13671","observation_id":"35763719-145c-4a71-aea9-067e3ed00619","resolution":{"observed_at":"2026-08-11T12:40:16.070755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-11T05:57:06.577402Z","title":"Arcee’s mergekit: A toolkit for merging large language mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17023","last_updated":"2024-12-22T13:58:12Z","snapshot_observed_at":"2026-08-17T18:28:38.650229Z","submitted_at":"2024-12-22T13:58:12Z","title":"Parameter-Efficient Interventions for Enhanced Model Merging","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:57:06.577402Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2412.17023"},"observation_digest":"sha256:688a19cedffa6659566dca43368b3741b2d1c89d7cae1705be211d2fe4627c28","observation_id":"efff6bbb-86ca-4724-9b0d-1fc748a7bab3","resolution":{"observed_at":"2026-08-11T05:57:06.577402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-10T21:22:06.031543Z","title":"Charles Goddard, Shamane Siriwardhana, Malikeh Ehghaghi, Luke Meyers, Vlad Karpukhin, Brian Benedict, Mark McQuade, and Jacob Solawetz","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.05559","last_updated":"2025-01-09T20:11:08Z","snapshot_observed_at":"2026-08-14T13:20:01.239912Z","submitted_at":"2025-01-09T20:11:08Z","title":"Soup to go: mitigating forgetting during continual learning with model averaging","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T21:22:06.031543Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2501.05559"},"observation_digest":"sha256:b2b7ca5b2d4e9361a45e6c92a0e4b8edad0304405c96b8b8d1199cad652d0661","observation_id":"15471346-957c-4072-809c-53c8fa04c992","resolution":{"observed_at":"2026-08-10T21:22:06.031543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-10T21:11:53.184915Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.06126","last_updated":"2025-03-28T22:40:47Z","snapshot_observed_at":"2026-08-15T16:48:10.066833Z","submitted_at":"2025-01-10T17:25:11Z","title":"Merging Feed-Forward Sublayers for Compressed Transformers","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T21:11:53.184915Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2501.06126"},"observation_digest":"sha256:ea7533c703b1849741a68dcf99776d4d0006d379974803aba6d90c642780eff2","observation_id":"0f2ddaa2-61c6-4e02-9b98-5874e8da1478","resolution":{"observed_at":"2026-08-10T21:11:53.184915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-10T21:28:02.661457Z","title":"Arcee's mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.06252","last_updated":"2025-01-24T01:26:30Z","snapshot_observed_at":"2026-08-18T06:39:07.017327Z","submitted_at":"2025-01-09T01:19:21Z","title":"Transformer-Squared: Self-adaptive LLMs","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T21:28:02.661457Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2501.06252"},"observation_digest":"sha256:ae8d49dd0827fdfa7cdb5964cf155e1184e812c37183b584c495cbe81911a1a6","observation_id":"6eaef8de-ba2f-40c2-80f1-4ced5ad4605b","resolution":{"observed_at":"2026-08-10T21:28:02.661457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-10T14:33:22.951335Z","title":"Preprint, arXiv:2403.13257","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15219","last_updated":"2025-01-25T13:50:18Z","snapshot_observed_at":"2026-08-14T04:13:36.546787Z","submitted_at":"2025-01-25T13:50:18Z","title":"Faster Machine Translation Ensembling with Reinforcement Learning and Competitive Correction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:22.951335Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2501.15219"},"observation_digest":"sha256:faed48bf0462e1938cad04f7c258d1e0db987587b97c5df5cebbd42a5a8f5dc7","observation_id":"5fad8eb9-f69d-4440-bd72-9008d5b41a38","resolution":{"observed_at":"2026-08-10T14:33:22.951335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-09T17:01:41.058844Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00997","last_updated":"2025-02-17T16:51:23Z","snapshot_observed_at":"2026-08-13T18:29:32.612859Z","submitted_at":"2025-02-03T02:34:46Z","title":"MergeME: Model Merging Techniques for Homogeneous and Heterogeneous MoEs","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T17:01:41.058844Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2502.00997"},"observation_digest":"sha256:88fbc203197a7005f022a7c3c6ace3e2169f8123d2b1d55aad2cafc63b711bb6","observation_id":"c1f194db-3c05-4ffe-84ec-ceef2e0a4c9f","resolution":{"observed_at":"2026-08-09T17:01:41.058844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-08T11:11:44.574179Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-17T23:27:17.875289Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.574179Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:8670fd2f398eef1c5f19d5b7bae598475369abeaacdbbf045a86570b8e0bb928","observation_id":"ef4643f8-036c-425e-a74f-17ed7d626ae7","resolution":{"observed_at":"2026-08-08T11:11:44.574179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-07T22:52:27.449256Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09056","last_updated":"2025-03-27T06:45:16Z","snapshot_observed_at":"2026-08-18T00:25:38.033357Z","submitted_at":"2025-02-13T08:10:45Z","title":"Adapting Language-Specific LLMs to a Reasoning Model in One Day via Model Merging -- An Open Recipe","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T22:52:27.449256Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2502.09056"},"observation_digest":"sha256:d4cd51dd926e29948942c6b16435898b15ff174cc9307e93ff38ee1607f5c0a6","observation_id":"07ef9962-ca36-4187-84ab-c691bea73031","resolution":{"observed_at":"2026-08-07T22:52:27.449256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2503.23733","last_updated":"2025-03-31T05:13:02Z","snapshot_observed_at":"2026-08-17T12:12:18.215657Z","submitted_at":"2025-03-31T05:13:02Z","title":"AdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T22:47:09.500229Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2503.23733"},"observation_digest":"sha256:0ae64e061f0b9911d3e15852f0f8007e6c5cd1a539cca0af3d9f24ae2375b981","observation_id":"884112f5-272d-4b8c-b1bb-14c493c604eb","resolution":{"observed_at":"2026-05-22T22:47:13.022569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-16T12:40:25.678637Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12364","last_updated":"2025-04-16T15:09:45Z","snapshot_observed_at":"2026-08-18T03:47:19.699686Z","submitted_at":"2025-04-16T15:09:45Z","title":"DMM: Building a Versatile Image Generation Model via Distillation-Based Model Merging","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.678637Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2504.12364"},"observation_digest":"sha256:8a632217687eb56a0c911194e12c620858cbc5116ecbc0844618307a2617abb7","observation_id":"b1fdbee0-037f-4c57-948c-8d4119dec463","resolution":{"observed_at":"2026-08-16T12:40:25.678637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-16T10:45:16.187811Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17360","last_updated":"2025-04-24T08:21:04Z","snapshot_observed_at":"2026-08-19T20:52:34.703702Z","submitted_at":"2025-04-24T08:21:04Z","title":"PatientDx: Merging Large Language Models for Protecting Data-Privacy in Healthcare","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T10:45:16.187811Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2504.17360"},"observation_digest":"sha256:bc560f9282478c0fd2ea0ac05d99de8e9f8a84b1b499c5081430c14d3dc48114","observation_id":"1a41cbea-f1a2-4f59-ad50-02e05d4b91ab","resolution":{"observed_at":"2026-08-16T10:45:16.187811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-16T11:08:33.149938Z","title":"Arcee's mergekit: A toolkit for merging large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.18580","last_updated":"2025-04-23T05:11:21Z","snapshot_observed_at":"2026-08-20T22:35:39.000876Z","submitted_at":"2025-04-23T05:11:21Z","title":"Parameter-Efficient Checkpoint Merging via Metrics-Weighted Averaging","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T11:08:33.149938Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2504.18580"},"observation_digest":"sha256:19872745d49a86b5212bbe0a9972d9f13aa42654983c865dcc0eaa554bb2fb7a","observation_id":"e60bff05-2974-4a1b-b911-7ab1a367e151","resolution":{"observed_at":"2026-08-16T11:08:33.149938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-15T23:36:29.977416Z","title":"preprint arXiv:2403.13257 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04388","last_updated":"2025-05-28T20:14:44Z","snapshot_observed_at":"2026-08-20T08:53:34.196898Z","submitted_at":"2025-05-07T13:13:14Z","title":"The Aloe Family Recipe for Open and Specialized Healthcare LLMs","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T23:36:29.977416Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2505.04388"},"observation_digest":"sha256:f184a0456c4534af9cd4a7cb2e710b7f5e4a0d3e30ee1a3952e6484bcdab93ce","observation_id":"693ec936-3e78-412c-b432-80094be561c1","resolution":{"observed_at":"2026-08-15T23:36:29.977416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-15T20:20:53.437259Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13273","last_updated":"2026-05-29T15:25:42Z","snapshot_observed_at":"2026-08-18T04:08:46.092075Z","submitted_at":"2025-05-19T15:53:32Z","title":"EMoE: Training-Free Expert Disagreement for Uncertainty-Aware Text-to-Image Diffusion","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:20:53.437259Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2505.13273"},"observation_digest":"sha256:25f761b780079ea1e63d9a10e05c9c6370af8e502ebb586bd4f71e81fc687ebb","observation_id":"a721c607-78de-4e5f-ac2a-397050559b1c","resolution":{"observed_at":"2026-08-15T20:20:53.437259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-07T15:18:30.678778Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15798","last_updated":"2025-05-21T17:51:05Z","snapshot_observed_at":"2026-08-14T17:51:13.686962Z","submitted_at":"2025-05-21T17:51:05Z","title":"Model Merging is Secretly Certifiable: Non-Vacuous Generalisation Bounds for Low-Shot Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:18:30.678778Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2505.15798"},"observation_digest":"sha256:9ced7030efc5afdbe237409acf4de217c6c22090d691abdc711f9f80a10861ba","observation_id":"f813858e-b38a-41ff-8888-5b48f64b5b94","resolution":{"observed_at":"2026-08-07T15:18:30.678778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-07T13:09:58.537084Z","title":"Arcee’s mergekit: A toolkit for merging large language models.arXiv preprint arXiv:2403.13257, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23844","last_updated":"2025-05-28T16:24:50Z","snapshot_observed_at":"2026-08-21T08:42:42.676268Z","submitted_at":"2025-05-28T16:24:50Z","title":"Enabling Flexible Multi-LLM Integration for Scalable Knowledge Aggregation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:09:58.537084Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2505.23844"},"observation_digest":"sha256:f0f1ffc43edcbe88580b6a428ab3283b3d73519ff4078bb77059ab6f209b5f96","observation_id":"ca392154-0900-4fe7-88ef-4e7ace0f4cb8","resolution":{"observed_at":"2026-08-07T13:09:58.537084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-06T20:59:03.405349Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.405349Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:c5820b3fc58d34bd6da9d541d0e91417eb4af59bb5464aa246ef5dec110ed8b6","observation_id":"233ec159-5fac-4c5a-bda5-1ed459a0591a","resolution":{"observed_at":"2026-08-06T20:59:03.405349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-15T18:15:01.087873Z","title":"Arcee's mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18807","last_updated":"2025-07-24T21:10:37Z","snapshot_observed_at":"2026-08-20T13:54:43.107876Z","submitted_at":"2025-07-24T21:10:37Z","title":"Fishers for Free? Approximating the Fisher Information Matrix by Recycling the Squared Gradient Accumulator","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T18:15:01.087873Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2507.18807"},"observation_digest":"sha256:c90fbb076c84b0188e706d84cebb05b888af86bf7a6f07a8fd7e764e084c1cae","observation_id":"ee750cd3-12b0-4caf-b578-99f6697106f6","resolution":{"observed_at":"2026-08-15T18:15:01.087873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T14:42:31.387903Z","title":"Arcee’s mergekit: A toolkit for merging large language mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21004","last_updated":"2025-08-28T17:05:18Z","snapshot_observed_at":"2026-08-14T02:54:54.073813Z","submitted_at":"2025-08-28T17:05:18Z","title":"Lethe: Purifying Backdoored Large Language Models with Knowledge Dilution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T14:42:31.387903Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2508.21004"},"observation_digest":"sha256:e4042c818d820bc79736c9b4cf847f24c0c608fd187a47a38f77267ec517255e","observation_id":"8aa7dde6-4bfb-4860-bd96-e88ddc227d69","resolution":{"observed_at":"2026-08-05T14:42:31.387903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T11:59:08.619716Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02108","last_updated":"2025-09-12T06:41:56Z","snapshot_observed_at":"2026-08-14T23:36:06.470149Z","submitted_at":"2025-09-02T09:04:41Z","title":"DivMerge: A divergence-based model merging method for multi-tasking","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T11:59:08.619716Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2509.02108"},"observation_digest":"sha256:578ad4e5756434f4a78885445921f9f73fcc8193e7d9b0af94d50097a9d66b64","observation_id":"81d1e394-35fe-47e5-af16-902cb1731a77","resolution":{"observed_at":"2026-08-05T11:59:08.619716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2601.14053","last_updated":"2026-04-16T15:26:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-20T15:06:19Z","title":"LLMOrbit: A Circular Taxonomy of Large Language Models -From Scaling Walls to Agentic AI Systems","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-16T12:47:28.248540Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2601.14053"},"observation_digest":"sha256:b0436777c95495b8b1de1a141ffaf7a01ac984deb477b46934ad69429293194d","observation_id":"58fbf7fb-aee2-4f27-9c6a-1bc13075754b","resolution":{"observed_at":"2026-05-16T12:47:53.708163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2604.11399","last_updated":"2026-08-16T14:51:04Z","snapshot_observed_at":"2026-08-20T23:12:26.459494Z","submitted_at":"2026-04-13T12:41:50Z","title":"Lost in Adaptation: Layer-Selective Recovery of Temporal Reasoning in Video-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T15:42:43.948462Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2604.11399"},"observation_digest":"sha256:42d5d368aa5748cd5c771c4fcdc050674e232ecdd76b231a9c29e13eb508abfd","observation_id":"0d3dde42-93a6-415a-8a7a-10cf2fd1c65e","resolution":{"observed_at":"2026-05-11T09:56:06.548129Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2605.01580","last_updated":"2026-05-02T19:06:35Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T19:06:35Z","title":"Model Merging: Foundations and Algorithms","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-09T14:47:58.710291Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2605.01580"},"observation_digest":"sha256:2fb48bd16c27b4e7cdd475ee3f8d072f0fb35a855b8c3ab829ff380452b5e66b","observation_id":"de71cd25-4c33-4593-b2f9-b88cffe983b5","resolution":{"observed_at":"2026-05-11T16:51:07.254863Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2606.03344","last_updated":"2026-06-02T08:54:37Z","snapshot_observed_at":"2026-08-14T08:59:39.927417Z","submitted_at":"2026-06-02T08:54:37Z","title":"RogueMerge: Robust and Unified Attacks against LLM Model Merging","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T10:05:10.309553Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2606.03344"},"observation_digest":"sha256:b0269db38c497bf13b0bbc2cd928312bf1b3acad7004f5fd41f8fba25c5a6ca8","observation_id":"6fe0c117-6cf9-45ef-98f0-fdaf2af920b0","resolution":{"observed_at":"2026-07-02T03:26:28.927806Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2606.09707","last_updated":"2026-06-08T16:26:09Z","snapshot_observed_at":"2026-08-02T14:57:41.811500Z","submitted_at":"2026-06-08T16:26:09Z","title":"BrainSurgery: Reproducible and Reliable Declarative Weight Manipulations for Model Editing and Upcycling","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T16:54:48.188242Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2606.09707"},"observation_digest":"sha256:75ca13d685e6ecebcd714cb94052157a47dbece9e6345010b0171cad505c5f88","observation_id":"8549a617-306f-486a-9f18-bd32ca59b9d5","resolution":{"observed_at":"2026-06-27T17:01:07.961529Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2606.19037","last_updated":"2026-06-17T13:06:47Z","snapshot_observed_at":"2026-08-09T02:57:50.077696Z","submitted_at":"2026-06-17T13:06:47Z","title":"Querit-Reranker: Training Compact Multilingual Rerankers via Efficient Label-Free Distribution Adaptation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T19:26:56.051694Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2606.19037"},"observation_digest":"sha256:d2a22839389cf7bded8a947fcf7844ead8755febef55ba8340f3950d39751e72","observation_id":"4fcc8288-6207-417e-a03b-aed0ff7b978f","resolution":{"observed_at":"2026-07-04T02:39:25.287241Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2607.08399","last_updated":"2026-07-09T12:21:44Z","snapshot_observed_at":"2026-08-05T01:38:41.823519Z","submitted_at":"2026-07-09T12:21:44Z","title":"Prompt Compression via Activation Aggregation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-10T08:03:46.297577Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2607.08399"},"observation_digest":"sha256:4ad732f44c7feda0002badcb432073bcc47731b95705fecafd888c8c2c20b338","observation_id":"29b07483-a301-42a1-a6a1-cd1664870279","resolution":{"observed_at":"2026-07-10T08:06:57.507921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.13257","doi":"10.48550/arxiv.2403.13257","metadata_source":"pith","pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":"cs.CL","work_id":"be216e9a-b2e1-4485-ba14-f8bbed2b7aa7","year":2024},"citing_paper":{"arxiv_id":"2607.08540","last_updated":"2026-07-09T14:35:14Z","snapshot_observed_at":"2026-08-14T05:52:17.147465Z","submitted_at":"2026-07-09T14:35:14Z","title":"Improving Ad-hoc Search Effectiveness for Conversational Information Retrieval via Model Merging","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T05:43:06.942867Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2607.08540"},"observation_digest":"sha256:0ffdfecaf6ceaa1c789bf3225c9e432b56fbe4e4a18a9877ca2fd50ed3642ddc","observation_id":"9c447ba5-af30-4c09-8fb9-82d91a1d7376","resolution":{"observed_at":"2026-07-10T05:46:50.348787Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.882707+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-07-14T10:27:28.207221Z","title":"Goddard et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10617","last_updated":"2026-07-12T07:29:18Z","snapshot_observed_at":"2026-08-17T15:20:42.148005Z","submitted_at":"2026-07-12T07:29:18Z","title":"modelDNA: Calibrated Lineage Verification and Merge Decomposition from Sampled Weight Fingerprints","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T10:27:28.207221Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2607.10617"},"observation_digest":"sha256:b1c81ed4758a12fe1ef8e84b647511b4435d8d18222f9c0d36463f49eb058022","observation_id":"2d8997ad-1b29-46e6-9d35-08200353ddcb","resolution":{"observed_at":"2026-07-14T10:27:28.207221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.13257/citation-record","integrity":"/paper/2403.13257/integrity","json":"/paper/2403.13257/citation-record.json","paper":"/paper/2403.13257"},"outbound":[],"paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 36 inbound Pith citation observations for arXiv:2403.13257."}