{"as_of":"2026-08-19T16:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab556ea6d07aa32db5ded00181792499ae8f040ce61be1660dfdaf6ad7613079","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:46:52.306168Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:01:02.173202Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T18:04:58.452201Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14662","snapshot_observed_at":"2026-08-09T17:01:02.173202Z","title":"Mitigating parameter interference in model merg- ing via sharpness-aware fine-tuning.arXiv preprint arXiv:2504.14662,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01015","last_updated":"2026-06-23T02:24:17Z","snapshot_observed_at":"2026-08-15T15:11:48.357266Z","submitted_at":"2025-02-03T03:18:26Z","title":"Task Vector Bases: A Unified and Scalable Framework for Compressed Task Arithmetic","version":5},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-09T17:01:02.173202Z"},"links":{"cited_paper":"/paper/2504.14662","citing_paper":"/paper/2502.01015"},"observation_digest":"sha256:5d5e53129ddf7585fbcce6110b267a478384bf83d51025a7aaba465f23441d11","observation_id":"913de135-63ae-4297-9c97-7b5e5bc1bac4","resolution":{"observed_at":"2026-08-09T17:01:02.173202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14662","snapshot_observed_at":"2026-08-07T10:45:00.372787Z","title":"Mitigating parameter interference in model merging via sharpness-aware fine-tuning.arXiv preprint arXiv:2504.14662,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04567","last_updated":"2025-06-05T02:37:10Z","snapshot_observed_at":"2026-08-15T17:07:34.068138Z","submitted_at":"2025-06-05T02:37:10Z","title":"StatsMerging: Statistics-Guided Model Merging via Task-Specific Teacher Distillation","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:00.372787Z"},"links":{"cited_paper":"/paper/2504.14662","citing_paper":"/paper/2506.04567"},"observation_digest":"sha256:c9480e86e2ff311c2997eab94574ad234ae7422bafd4e018aec0b77728fbf323","observation_id":"b4fd1448-f4a4-4a38-a43c-f468cee97cc2","resolution":{"observed_at":"2026-08-07T10:45:00.372787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2504.14662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14662","snapshot_observed_at":"2026-06-30T18:04:58.452201Z","title":"Mitigating parameter interfer- ence in model merging via sharpness-aware fine-tuning","venue":null,"work_id":"4607eefc-9be5-4d22-8e25-a736f3e4e21a","year":null},"citing_paper":{"arxiv_id":"2605.19409","last_updated":"2026-05-23T16:39:38Z","snapshot_observed_at":"2026-08-14T20:55:24.540334Z","submitted_at":"2026-05-19T06:03:20Z","title":"Unlocking the Potential of Continual Model Merging: An ODE Perspective","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T07:36:04.114811Z"},"links":{"cited_paper":"/paper/2504.14662","citing_paper":"/paper/2605.19409"},"observation_digest":"sha256:9ec494cd200dcb397e34e691b19cbdf35dc9b43ee79ed1e6d292c9ab38557351","observation_id":"c4042c61-8c6d-4e72-bee2-bd724fe00bde","resolution":{"observed_at":"2026-05-20T07:38:09.295515Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2504.14662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14662","snapshot_observed_at":"2026-06-30T18:04:58.452201Z","title":"Mitigating parameter interfer- ence in model merging via sharpness-aware fine-tuning","venue":null,"work_id":"4607eefc-9be5-4d22-8e25-a736f3e4e21a","year":null},"citing_paper":{"arxiv_id":"2605.19409","last_updated":"2026-05-23T16:39:38Z","snapshot_observed_at":"2026-08-14T20:55:24.540334Z","submitted_at":"2026-05-19T06:03:20Z","title":"Unlocking the Potential of Continual Model Merging: An ODE Perspective","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T08:32:04.249711Z"},"links":{"cited_paper":"/paper/2504.14662","citing_paper":"/paper/2605.19409"},"observation_digest":"sha256:a98cec73822fe281ee5ab9cc41d70ebc28adea26f18cfc0391883f89f84e0aad","observation_id":"63f41deb-6f5f-4a36-b21b-0e887e2acdaa","resolution":{"observed_at":"2026-05-21T08:34:05.510155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2504.14662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14662","snapshot_observed_at":"2026-06-30T18:04:58.452201Z","title":"Mitigating parameter interfer- ence in model merging via sharpness-aware fine-tuning","venue":null,"work_id":"4607eefc-9be5-4d22-8e25-a736f3e4e21a","year":null},"citing_paper":{"arxiv_id":"2605.19409","last_updated":"2026-05-23T16:39:38Z","snapshot_observed_at":"2026-08-14T20:55:24.540334Z","submitted_at":"2026-05-19T06:03:20Z","title":"Unlocking the Potential of Continual Model Merging: An ODE Perspective","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T17:55:17.067856Z"},"links":{"cited_paper":"/paper/2504.14662","citing_paper":"/paper/2605.19409"},"observation_digest":"sha256:8bf0f4be821ad6725e37e551249cd9f2ca1f1875e1e84a42dd10ff61951f5f7e","observation_id":"b57c6ba9-6b0b-41b1-84fd-93a218a82bd5","resolution":{"observed_at":"2026-06-30T18:04:58.453671Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14662","snapshot_observed_at":"2026-08-01T02:42:44.847743Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25366","last_updated":"2026-07-28T07:17:44Z","snapshot_observed_at":"2026-08-09T03:33:30.122090Z","submitted_at":"2026-07-28T07:17:44Z","title":"Sharpness-aware Model Merging with Salience Recovery for LLM-based Cross-Domain Sequential Recommendation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T02:42:44.847743Z"},"links":{"cited_paper":"/paper/2504.14662","citing_paper":"/paper/2607.25366"},"observation_digest":"sha256:d8b76ebb753589a00c2d427e2bb904e448e1982ad031507d844a416e82474f1b","observation_id":"ee601663-becd-42f0-83c1-82b32f1b42a3","resolution":{"observed_at":"2026-08-01T02:42:44.847743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.14662/citation-record","integrity":"/paper/2504.14662/integrity","json":"/paper/2504.14662/citation-record.json","paper":"/paper/2504.14662"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.050850Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.050850Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:04efc9938b7fda6ca908635dde5d8c9bdb3a52104896f3b173489161b099089b","observation_id":"9790112a-dbf0-436c-a4f5-3e9c712be049","resolution":{"observed_at":"2026-08-16T11:46:52.050850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T11:46:52.056605Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.056605Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:4ca7c40bd083165cabe4a12250007269b53b0ed9b9cf54035558960b76cf1af2","observation_id":"39b233cb-dafb-45d4-80a4-d2430c478bd2","resolution":{"observed_at":"2026-08-16T11:46:52.056605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.192148Z","title":"Sam operates far from home: eigenvalue regularization as a dynamical phenomenon","venue":null,"work_id":"b4393389-c987-451c-b9cc-343b4e33c976","year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.061392Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:ef5804cc79e7361cf41f8998b5e6f7b0c71989607903b0c68564b48bdf1c2440","observation_id":"d3f2778e-ea9e-4337-8ab9-42eaa3ff72ac","resolution":{"observed_at":"2026-08-16T11:46:53.196755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.177889Z","title":"Multitask learning","venue":null,"work_id":"928cbe58-e2e0-401b-a806-68c96ff84068","year":1997},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.066137Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:5441c689859e2fff458c305c22d5fe0b984247980b8ed531b0ad46c8d8078d7e","observation_id":"1d9b276a-0787-41c6-91f2-bfba70e0918e","resolution":{"observed_at":"2026-08-16T11:46:53.182439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.164069Z","title":"Swad: Domain generalization by seeking flat minima","venue":null,"work_id":"8bdaf47a-6f7f-4107-b559-b8021f022960","year":2021},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.070538Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:b41338bf92efcd708834b9fcb072356987b37eb1409c13d34b46d4dfe865c482","observation_id":"9a6559e4-2c52-458e-82c1-713657912996","resolution":{"observed_at":"2026-08-16T11:46:53.168502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.074953Z","title":"Remote sensing image scene classification: Benchmark and state of the art","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.074953Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:3dba32319d3b0726f5651afeaa251a6018cf91185e88403683e1c7467efbfcce","observation_id":"64bc1d3f-af0d-4954-9e6e-6b8ccde15888","resolution":{"observed_at":"2026-08-16T11:46:52.074953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.079324Z","title":"Describing textures in the wild","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.079324Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:5d79e74e7399b79f32d48d2ce9a8c5f6c1d63ab2af4189f5d8eeaba286136d03","observation_id":"b2d74f63-a821-4785-9328-72fc8dc2febd","resolution":{"observed_at":"2026-08-16T11:46:52.079324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.131736Z","title":"Model merging by uncertainty-based gradient matching","venue":null,"work_id":"2655daca-776b-4722-bd94-b56030c6f4e5","year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.088672Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:bcd3acf49cbf4a480067914a15b39b16dee17a0ca2a1746a2928870c962265f4","observation_id":"ed3d5990-5a19-41a2-9d08-c285b6d34510","resolution":{"observed_at":"2026-08-16T11:46:53.136355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.117564Z","title":"The mnist database of handwritten digit images for machine learning research [best of the web]","venue":null,"work_id":"e4d14529-9f62-4e02-a88b-1bf7c5d2ae92","year":2012},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.093142Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:3d41b24d34bbe27507d87e2fd399671dbccd0f1b1ce78d12bc4d11425754d82c","observation_id":"5a4f836f-bc61-4e78-b78f-8bfa843cb768","resolution":{"observed_at":"2026-08-16T11:46:53.122336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.103668Z","title":"Parameter-efficient fine-tuning of large-scale pre-trained language models","venue":null,"work_id":"0a87a5bd-3468-4229-bb3c-699383278232","year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.097481Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:528b3f04a36541856f01ed2e5a7ba3a92045d3df0d3a25e8db32d17e77be33be","observation_id":"678e0adb-310d-4af9-9616-e6af30bcf47c","resolution":{"observed_at":"2026-08-16T11:46:53.108324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.089046Z","title":"Sharpness-aware training for free","venue":null,"work_id":"30f31d84-0e6b-4c7d-b4c4-aa93ece529c0","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.101799Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:7d587cd0246321f13ccd786abc0c23fe34967c495c7d20c8ac270f2d84956b3c","observation_id":"2c58aa9f-d05f-4ecb-8270-749b99a9ed05","resolution":{"observed_at":"2026-08-16T11:46:53.093803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.105984Z","title":"Sharpness-aware minimization for efficiently improving generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.105984Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:ecc2e47c8b9af7131253f551c531c2f6a2e81acb0872c461130ee71a64f22533","observation_id":"1b6e6782-8e3d-4667-a9bb-4752a5d8b604","resolution":{"observed_at":"2026-08-16T11:46:52.105984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.110228Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.110228Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:9a25d6db1985f9c4cfeaf61423d8339dad25403e38c21b92be1c224d1322c9db","observation_id":"427ca516-6826-40b6-8e07-369f82516f24","resolution":{"observed_at":"2026-08-16T11:46:52.110228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.056160Z","title":"Patching open-vocabulary models by interpolating weights","venue":null,"work_id":"1f589d2e-35fb-418f-aab4-ee77c3f6c595","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.114775Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:944110aacd3d660be519a26f31893e2f4f1287a1777b3a1af13d39434cd1ae2b","observation_id":"bde69c4d-6ef9-405f-ba8c-10f3d3e78635","resolution":{"observed_at":"2026-08-16T11:46:53.060839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.041400Z","title":"Editing models with task arithmetic","venue":null,"work_id":"ba6ffeda-d815-4334-b855-7693518150cb","year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.119734Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:e511c964fd42e3bc5fe55b4ad22c9978c49389bc63d9693fa5036e0ab09b12b7","observation_id":"dfd3faf2-ea68-4ff2-b330-02b712d0a906","resolution":{"observed_at":"2026-08-16T11:46:53.046147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.026577Z","title":"Averaging weights leads to wider optima and better generalization","venue":null,"work_id":"014232b3-5a97-4cfe-84b1-f5dd41e774e5","year":2018},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.124633Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:fa7cb4b6adb24877d439fc6d8c29014bb3fb7f094763f846cfe69ba06ad4cad2","observation_id":"ac448e27-d2e5-4276-a065-82d2ca6ac03f","resolution":{"observed_at":"2026-08-16T11:46:53.031188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:53.012630Z","title":"Fine-tuning attention modules only: Enhancing weight disentanglement in task arithmetic","venue":null,"work_id":"4a66338d-ecd8-4671-92c2-d65aa3d26192","year":2025},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.129011Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:00f0820a75fd2b7aae50a39dfc084cefe55af434802177df5a5c25c4a83e4fde","observation_id":"853153cd-21e5-4312-84c4-b49829fd759d","resolution":{"observed_at":"2026-08-16T11:46:53.017403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.133200Z","title":"Dataless knowledge fusion by merging weights of language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.133200Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:7c1b4e1d93878faca04779a968fe3212466eea63708ba148aa4a685a45f2a85d","observation_id":"490a8b6a-7dea-4150-99d5-488acd62a14e","resolution":{"observed_at":"2026-08-16T11:46:52.133200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.988804Z","title":null,"venue":null,"work_id":"76edec51-859e-47bf-90b0-3c1c328038df","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.137618Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:1318e229a50d67dbc1d4b399f9d672a9736eeae577dbfde14e737f59f8b66d3d","observation_id":"90e3955b-e8fb-44ee-9195-5645c8506d18","resolution":{"observed_at":"2026-08-16T11:46:52.993153Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.974273Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"77d285cf-f47e-4ed9-97d1-d2ba62a4d57f","year":2013},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.142470Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:d3df6e91aecec072a625d80a1cc5da6a843a75b9662b6c1833630615e73aeb6f","observation_id":"ca2bfd0a-a153-478f-8582-9f6cc9a296c8","resolution":{"observed_at":"2026-08-16T11:46:52.978623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.960340Z","title":"Asam: Adaptive sharpness-aware minimization for scale-invariant learning of deep neural networks","venue":null,"work_id":"cb2f7373-3d7e-4afa-929a-d33b0f119e57","year":2021},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.146606Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:c7812f440d9b24e6f611f782c8d92e7d999c88d511b73b11d2ef9458af238205","observation_id":"ca043315-7c1c-4f99-9fc7-4a7c58566e54","resolution":{"observed_at":"2026-08-16T11:46:52.964984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11489","last_updated":"2022-11-21T14:24:34Z","snapshot_observed_at":"2026-08-16T16:14:31.499334Z","submitted_at":"2022-11-21T14:24:34Z","title":"Efficient Generalization Improvement Guided by Random Weight Perturbation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11489","snapshot_observed_at":"2026-08-16T11:46:52.150959Z","title":"Efficient generalization improvement guided by random weight perturbation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.150959Z"},"links":{"cited_paper":"/paper/2211.11489","citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:cdc98afe1ab123d31fb7d8e73321982091ac8580533bdbcfd6d0626ee8220f68","observation_id":"caffa68a-7af1-4c5a-98b1-1764425cde6f","resolution":{"observed_at":"2026-08-16T11:46:52.150959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.946141Z","title":"Friendly sharpness-aware minimization","venue":null,"work_id":"bc41dd17-9f0b-4df0-80b8-8692068bc2b1","year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.155396Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:cf6940bc7c906752ecd3650e89427a8b572ba1f9dcee7e3f52664a9e84913a2e","observation_id":"144a9c3d-6267-46a6-b06a-6e5827767814","resolution":{"observed_at":"2026-08-16T11:46:52.950939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15698","last_updated":"2023-09-27T14:40:12Z","snapshot_observed_at":"2026-08-16T14:57:10.140230Z","submitted_at":"2023-09-27T14:40:12Z","title":"Deep Model Fusion: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15698","snapshot_observed_at":"2026-08-16T11:46:52.159807Z","title":"Deep model fusion: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.159807Z"},"links":{"cited_paper":"/paper/2309.15698","citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:9acb2fcbc51854fda2314870dbccdadae31bb81e2a819f059d49c9810638e76e","observation_id":"6065d512-89eb-443d-aa61-cc31071e8631","resolution":{"observed_at":"2026-08-16T11:46:52.159807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.931828Z","title":"Towards efficient and scalable sharpness-aware minimization","venue":null,"work_id":"03e96de8-b49b-4115-aae9-2fdcb87c8c29","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.164593Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:d8954a7a847aeeb2fb17e0e8d6f6a7b71c64b5ad8839a7bb022940946b238d48","observation_id":"50a20f6c-be2c-4752-9e32-b842f131d0d7","resolution":{"observed_at":"2026-08-16T11:46:52.936476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.168902Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.168902Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:ed10b4d08916af911cfc552ebde5d4e96426b7f7c4b4c68fb2eca55b88004b97","observation_id":"f8b604fb-aabc-4785-944e-364a449f83ed","resolution":{"observed_at":"2026-08-16T11:46:52.168902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.906661Z","title":"A kernel-based view of language model fine-tuning","venue":null,"work_id":"d925f44b-65ce-49b7-b01b-021e8d8c950b","year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.173190Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:bc8b9f6284a721e5de010f3be89fee112cc0d1e3a50c4a43c5543e11629d465d","observation_id":"a96450d4-0905-48f2-b2b6-f7400f19492e","resolution":{"observed_at":"2026-08-16T11:46:52.911793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.892185Z","title":"Merging models with fisher-weighted averaging","venue":null,"work_id":"64bb7ab1-b11f-455e-8580-c7bab50d03e4","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.177425Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:b938657f20770068416a757b10cf991741d0a85cd3539bbbe171bbdd33ae2afe","observation_id":"8400c1e3-c5e6-421b-b86a-1108415b11b2","resolution":{"observed_at":"2026-08-16T11:46:52.896822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.877802Z","title":"Make sharpness-aware minimization stronger: A sparsified perturbation approach","venue":null,"work_id":"f6abcc4c-bbf0-462f-90e1-f4c9399c6e3e","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.181719Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:eec8a5a55c6e7ba5c726bc98c18cebf0f81349b8328b21debcd48db89fe58614","observation_id":"9601586f-6d26-42f6-884d-81f8c68b0fd4","resolution":{"observed_at":"2026-08-16T11:46:52.882490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.864188Z","title":"Ng, et al","venue":null,"work_id":"02fa6266-710a-4485-b20c-ea39f83ceff1","year":2011},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.185955Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:9b81033055b34a2858bacd5433ddba6c87af1a785d09cbf0193ae3b1b496299a","observation_id":"f2ba6521-19ea-4a9b-906b-cbd4cf059073","resolution":{"observed_at":"2026-08-16T11:46:52.868499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.850359Z","title":"Task arithmetic in the tangent space: Improved editing of pre-trained models","venue":null,"work_id":"b11c6778-b4a8-42f6-a58f-033c4e9599e0","year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.190448Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:eb8026606bedf5de2093747fbbb627c173158b91a5f56c243fc30fae5b55777e","observation_id":"41a09f80-33c0-46ac-94a8-63b2d581396b","resolution":{"observed_at":"2026-08-16T11:46:52.854858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.194489Z","title":"Tran, Tuan Truong, Nhat Ho, Dinh Phung, and Trung Le","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.194489Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:a05c78861b2fffa75b4cd4be53cc9233ebc2a04ce63f63adb373bd7a0a03c4d2","observation_id":"21da6015-ab84-4b54-ac1f-8d8ca34656bc","resolution":{"observed_at":"2026-08-16T11:46:52.194489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.198572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.198572Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:54444098d296ea52d637455a79878c80c7607de683d0c6b059f5652354e3c3b0","observation_id":"8ce953c0-9c53-4822-9f83-f57b84dbd11b","resolution":{"observed_at":"2026-08-16T11:46:52.198572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-08-14T16:16:21.567225Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-16T11:46:52.202539Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.202539Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:0696e0a95bbb1035d15988f432e60986aee7191c28a9347f550002ffd81fa5de","observation_id":"c5748666-b98e-4ab4-941d-9bd16077c1db","resolution":{"observed_at":"2026-08-16T11:46:52.202539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18416","last_updated":"2024-05-01T17:12:10Z","snapshot_observed_at":"2026-07-06T18:06:49.190172Z","submitted_at":"2024-04-29T04:11:28Z","title":"Capabilities of Gemini Models in Medicine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18416","snapshot_observed_at":"2026-08-16T11:46:52.207293Z","title":"Capabilities of gemini models in medicine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.207293Z"},"links":{"cited_paper":"/paper/2404.18416","citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:7220abffae18b2c84b00fccd45557757f055a68c463fe847189a72d78e2531cd","observation_id":"bb78be94-b136-4c19-aecd-414cce3243cd","resolution":{"observed_at":"2026-08-16T11:46:52.207293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.827315Z","title":"Animating rotation with quaternion curves","venue":null,"work_id":"fefe86a5-e406-4c80-9b6b-ba6a8e8f9dd7","year":1985},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.211673Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:99078409c4b96462e04d1f0670139c3ce209308f97f132f58d9731ab387de1b1","observation_id":"94029e53-0711-4a54-8f47-c3e682d57abe","resolution":{"observed_at":"2026-08-16T11:46:52.831710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.813311Z","title":"The german traffic sign recognition benchmark: a multi-class classification competition","venue":null,"work_id":"f237526b-daf1-446c-8b10-0c24da60f8f8","year":2011},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.215876Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:583bebb4871804bf67418cfb09fea51ade5181625484ca21a12dd011654bfd3d","observation_id":"95c8541c-eb4e-40b8-8294-538124be0e54","resolution":{"observed_at":"2026-08-16T11:46:52.817802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.798767Z","title":"Parameter efficient multi-task model fusion with partial linearization","venue":null,"work_id":"15aebeb9-4ea2-4393-a865-32e7419e9577","year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.220936Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:566167adc5a294f5ded992a2bc29ad6d2c58604015ef31ad69042ac901350852","observation_id":"7332e4c0-15f9-46e2-a11c-4cb5bd93fcb1","resolution":{"observed_at":"2026-08-16T11:46:52.803896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.783700Z","title":"Weight averaging for neural networks and local resampling schemes","venue":null,"work_id":"d337ced8-d86d-4ab1-8b35-e4262e5c7127","year":1996},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.225841Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:9a516bde6c0a754ab6bf5df3b39564d18b19fee089b6d1fa2ecb787a21b9bb9f","observation_id":"e85f04a7-ee79-4c3d-8b33-179df5401f7f","resolution":{"observed_at":"2026-08-16T11:46:52.788844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.768784Z","title":"Multi-task learning for dense prediction tasks: A survey","venue":null,"work_id":"99f96c75-6308-48b5-bc91-fa7d394fd664","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.230616Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:4ba24e68d22abbb73928f511ee501d2e7bad2116d1419844ebddb0bbe61c1102","observation_id":"30536df0-a5ee-4004-a30f-768aba363fc1","resolution":{"observed_at":"2026-08-16T11:46:52.773410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.754770Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"603142d0-47c9-4994-adbf-7ce707df3e92","year":2017},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.235023Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:6de8972a63a766e32229c25673cafec9508b3093e329cf42d30324a6511dfb12","observation_id":"e11bb90b-4201-4409-a934-8bf25ab02eb8","resolution":{"observed_at":"2026-08-16T11:46:52.759269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.741256Z","title":null,"venue":null,"work_id":"8b8f7541-d2af-47bb-b2e9-eb86a3d08d86","year":2019},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.239904Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:9d720fb1c39bd7ac080d1c400bd8188d1b3d5f0f00313ef9e6ac5c624576816c","observation_id":"b3db906b-63f6-49f4-823e-989045bb981b","resolution":{"observed_at":"2026-08-16T11:46:52.745593Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.726468Z","title":"Localizing task information for improved model merging and compression","venue":null,"work_id":"02699416-ea00-46d1-b11b-00f8f668c1a3","year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.244409Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:02f26320f5aad5871d36fa690278dc4f5891aa9c42402f0f6792c4bd983b4d74","observation_id":"b61031d3-609b-415e-8d2d-1e8551b2eb6e","resolution":{"observed_at":"2026-08-16T11:46:52.731460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.712214Z","title":"Sharpness-aware gradient matching for domain generalization","venue":null,"work_id":"00f79374-7990-44ad-8907-627eb189ec2a","year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.248680Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:32f1cd0f6f484edf8386930cf303abd108a1f02fcc49d49fd0d6adb46d68ca5f","observation_id":"f1d9c846-6107-45cc-9cf1-48d979a4932a","resolution":{"observed_at":"2026-08-16T11:46:52.716560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.252761Z","title":"Dai, and Quoc V Le","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.252761Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:a541545559c1003087f30d9fc01b39df21782775185a687a395266f846fa5518","observation_id":"6459f13a-6a71-4c2d-b5c0-ad22470e9ac9","resolution":{"observed_at":"2026-08-16T11:46:52.252761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.687572Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time","venue":null,"work_id":"3802bf3a-e957-4337-af47-12f3a9e4cacf","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.256942Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:17a2bdf8be9d8d0c6b07742ab48629d425deb06f435710ce355fc5e3dbeab068","observation_id":"a960d68d-ca05-4e55-b3b6-d61897180429","resolution":{"observed_at":"2026-08-16T11:46:52.692574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.673015Z","title":"Robust fine-tuning of zero-shot models","venue":null,"work_id":"95c51dfc-d267-496e-b67b-f300aaffa5d2","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.261587Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:d1c01f409aa465b0769fed551a6e5b701fe8dd7e2acdb1c3bd714de0b6aee259","observation_id":"741798c9-f846-4bee-a6ba-9309c16e2dba","resolution":{"observed_at":"2026-08-16T11:46:52.677734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.658909Z","title":"Ehinger, James Hays, Antonio Torralba, and Aude Oliva","venue":null,"work_id":"7468faf5-fe18-4cad-900b-70d15979cd65","year":2016},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.265854Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:04e086a4cfb79621720457924ab0f6559c740a758a43a2ad9f463bc5ea734b84","observation_id":"c3731f17-704e-4b85-90d1-50dbb4f3313b","resolution":{"observed_at":"2026-08-16T11:46:52.663270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.643855Z","title":"Ties-merging: Resolving interference when merging models","venue":null,"work_id":"26388a5a-7fec-4562-aa0f-f4fd04e627da","year":2023},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.270040Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:01308ac72f7901f70243af6d6927ee4a8efb2b0614d1723748bd042e288658bd","observation_id":"0d4a9b06-9593-4e0f-960a-9aa1368a5d01","resolution":{"observed_at":"2026-08-16T11:46:52.648639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07666","last_updated":"2025-12-31T04:06:49Z","snapshot_observed_at":"2026-08-07T23:28:24.025478Z","submitted_at":"2024-08-14T16:58:48Z","title":"Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07666","snapshot_observed_at":"2026-08-16T11:46:52.274158Z","title":"Model merging in llms, mllms, and beyond: Methods, theories, applications and opportunities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.274158Z"},"links":{"cited_paper":"/paper/2408.07666","citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:6682f3c6dad42101a88ac170bdf02f692da7c79dcd12e2098c970d0ebf922b48","observation_id":"bf9a3c36-d3ae-47ea-911f-333d6d224ff9","resolution":{"observed_at":"2026-08-16T11:46:52.274158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.628259Z","title":"Adamerging: Adaptive model merging for multi-task learning","venue":null,"work_id":"2c8e6f97-d317-4f28-aa26-7db27975e47d","year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.278748Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:8d7f80d211eea2f18a12905f85176d0ca8bb2a709f089eea3d6eda0facadd670","observation_id":"e037a67b-0269-475a-9028-8f1cae98278d","resolution":{"observed_at":"2026-08-16T11:46:52.632921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.283141Z","title":"Language models are super mario: Absorbing abilities from homologous models as a free lunch","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.283141Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:ef9475c320497e35e5099eb8e7ace18d9f61b781c3e190bbb13d2d3dd87ea231","observation_id":"809dc2b0-f214-4049-adba-8849efc934ca","resolution":{"observed_at":"2026-08-16T11:46:52.283141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.605746Z","title":"Penalizing gradient norm for efficiently improving generalization in deep learning","venue":null,"work_id":"07e0ae8a-3338-4c05-9332-01dfd40ae726","year":2022},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.287305Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:26944c95d48887904b3a0ac38e28660087ff37e7412f54d90aa3708934be646b","observation_id":"d6c7460c-5225-4d37-8512-eb97b6c21345","resolution":{"observed_at":"2026-08-16T11:46:52.610283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.588068Z","title":"On the emergence of cross-task linearity in the pretraining-finetuning paradigm","venue":null,"work_id":"65915a16-9065-4cc2-84a2-6ba97f2f1869","year":2024},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.291657Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:ac89b84c93bb655ee43fdf58cd5638eb3396b8c63e5b82452addd6ec9f636e24","observation_id":"195be6a6-3eb9-4540-8a81-da4562bb8054","resolution":{"observed_at":"2026-08-16T11:46:52.595099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.296055Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.296055Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:4690f155e89e4fb5e5b8dafc5050311348a487aad55d147789fa033a11f0d1cc","observation_id":"b4358be3-2b6d-4bc8-bbb7-d56bb4fdbb76","resolution":{"observed_at":"2026-08-16T11:46:52.296055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:46:52.301140Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.301140Z"},"links":{"citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:5752c3e75ec2be8f37897b9c3949641c9d08931e2fc8ce9d43db9250a2059fb2","observation_id":"f230d1c9-7ebf-47dd-896c-20875087493f","resolution":{"observed_at":"2026-08-16T11:46:52.301140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09796","last_updated":"2020-09-10T19:31:04Z","snapshot_observed_at":"2026-08-09T08:30:49.737024Z","submitted_at":"2020-09-10T19:31:04Z","title":"Multi-Task Learning with Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09796","snapshot_observed_at":"2026-08-16T11:46:52.306168Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:52.306168Z"},"links":{"cited_paper":"/paper/2009.09796","citing_paper":"/paper/2504.14662"},"observation_digest":"sha256:0a03094c988b949e2b5f8673727201c920638964993080c40dab7f2ab38d5dc2","observation_id":"e1b675bb-f8ce-451a-a9ff-f7d59d889391","resolution":{"observed_at":"2026-08-16T11:46:52.306168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.14662","last_updated":"2025-04-20T15:57:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T17:04:18.228768Z","submitted_at":"2025-04-20T15:57:12Z","title":"Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":35},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 6 inbound Pith citation observations for arXiv:2504.14662."}