{"as_of":"2026-08-07T17:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b6eb8121c53d10395a41f8394718032f6afe37bec547fac444b794a17cd3d78","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T19:16:04.999697Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T21:12:06.989077Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-14T21:12:58.892326Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"cited_work":{"arxiv_id":"2512.01461","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.01461","snapshot_observed_at":"2026-06-30T03:17:25.261573Z","title":"Stay unique, stay efficient: Preserving model personality in multi-task merging","venue":null,"work_id":"3de52971-58db-4e99-ae0c-065f7924aa63","year":2025},"citing_paper":{"arxiv_id":"2605.11679","last_updated":"2026-05-13T09:28:34Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:38:59Z","title":"Explaining and Breaking the Safety-Helpfulness Ceiling via Preference Dimensional Expansion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T01:03:10.263663Z"},"links":{"cited_paper":"/paper/2512.01461","citing_paper":"/paper/2605.11679"},"observation_digest":"sha256:20f986eea57e05a2ca052b33cf04b2a39c222f83903377192aaa8a1f2fbb0f81","observation_id":"e522c0d3-3187-4312-9b12-9b693b87bc25","resolution":{"observed_at":"2026-06-30T03:17:25.261573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"cited_work":{"arxiv_id":"2512.01461","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.01461","snapshot_observed_at":"2026-06-30T03:17:25.261573Z","title":"Stay unique, stay efficient: Preserving model personality in multi-task merging","venue":null,"work_id":"3de52971-58db-4e99-ae0c-065f7924aa63","year":2025},"citing_paper":{"arxiv_id":"2605.11679","last_updated":"2026-05-13T09:28:34Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:38:59Z","title":"Explaining and Breaking the Safety-Helpfulness Ceiling via Preference Dimensional Expansion","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-14T21:12:06.989077Z"},"links":{"cited_paper":"/paper/2512.01461","citing_paper":"/paper/2605.11679"},"observation_digest":"sha256:968d9421da2ee6f369ad3cb0b2b1fe8887c35f17986c54338b85fbcd470f88a4","observation_id":"19ecc26c-6536-4bfb-9a4c-3a81b4f2e090","resolution":{"observed_at":"2026-06-30T03:17:25.261573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.01461/citation-record","integrity":"/paper/2512.01461/integrity","json":"/paper/2512.01461/citation-record.json","paper":"/paper/2512.01461"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:50.783729Z","title":"Git re-basin: Merging models modulo permutation symmetries","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:50.783729Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:c81e981c7fdb1e29fd6800e2093c2b83884c415f9dc19422cdea46758b456a53","observation_id":"da399615-8fbb-4b24-b938-fe22c4bfd0ef","resolution":{"observed_at":"2026-08-03T19:15:50.783729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-03T19:15:50.873340Z","title":"Qwen technical report.arXiv preprint arXiv:2309.16609,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:50.873340Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:fee72077e03ccb694eb8b23a1f7157d424d9c84b0e07ad2982354dbee1b73aed","observation_id":"b07ffe1c-0c09-4324-a646-bb87d8b19463","resolution":{"observed_at":"2026-08-03T19:15:50.873340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:50.963658Z","title":"Multitask learning.Machine learning, 28(1): 41–75, 1997","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:50.963658Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:090e822b233db3d8ced49aa06729a36322c107eb016a6baedecca52e9679b271","observation_id":"28dd684c-b709-4a27-964d-05dac9aaed0c","resolution":{"observed_at":"2026-08-03T19:15:50.963658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:51.095132Z","title":"Semeval-2017 task 1: Semantic textual similarity multilingual and crosslingual focused evaluation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:51.095132Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:514125e7bc10de02e0a8ca9b7040b46dc5ff19f4176499ffe392ee31f77b24cc","observation_id":"e992de7c-3f6b-450a-8b90-b0b43539e11a","resolution":{"observed_at":"2026-08-03T19:15:51.095132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:51.252755Z","title":"Fw-merging: Scaling model merging with frank-wolfe optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:51.252755Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:8c3e5872f499a996810113263ac511c2b73f301dfd3329d00bbbf23125455bae","observation_id":"de5ec714-ec6f-4e0f-bc99-b65a1b40f4fc","resolution":{"observed_at":"2026-08-03T19:15:51.252755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:51.424928Z","title":"Quora question pairs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:51.424928Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:36ddfa9a0ce5070310929e5507b98606dd42ae487757c5a4be9504c9ab324571","observation_id":"336b8f46-82db-4710-9d67-3687a94639ef","resolution":{"observed_at":"2026-08-03T19:15:51.424928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:51.567201Z","title":"Remote sensing image scene classification: Benchmark and state of the art","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:51.567201Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:56ad5882c2f779bb54e0f0b2246f32f49738f441e1e3e68a96ca6529a82cc763","observation_id":"12efaed5-dd10-4d1d-ae86-4be31b08a428","resolution":{"observed_at":"2026-08-03T19:15:51.567201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:51.756694Z","title":"Describing textures in the wild","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:51.756694Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:76a5bc50109d0d9318eeddf899dc9d6ddc30788fe560fe2435726d19815e892a","observation_id":"9fcd8eea-b3b3-4733-b9c9-78019ba3f713","resolution":{"observed_at":"2026-08-03T19:15:51.756694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:51.928142Z","title":"Model breadcrumbs: scalable upcycling of finetuned foundation models via sparse task vectors merging","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:51.928142Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:4fc0cb63ce2e801fbc7fa0dcbd84b5477e7f67f42a1b692bc0c323850914ebcc","observation_id":"b11c9aa3-2bd8-431e-b30a-b9e113337182","resolution":{"observed_at":"2026-08-03T19:15:51.928142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:52.105687Z","title":"The mnist database of handwritten digit images for machine learning research.IEEE signal processing magazine, pages 141–142, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:52.105687Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:c15e644dd4de86ebe94fd96f70a43c24fe3398d6e6de994ba732e452d1ca796f","observation_id":"ddbf7887-15fd-4f7d-a1d2-ee1b2829481c","resolution":{"observed_at":"2026-08-03T19:15:52.105687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09446","last_updated":"2025-06-11T06:52:36Z","snapshot_observed_at":"2026-08-07T04:45:42.093041Z","submitted_at":"2025-06-11T06:52:36Z","title":"Harmonizing and Merging Source Models for CLIP-based Domain Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09446","snapshot_observed_at":"2026-08-03T19:15:52.251953Z","title":"Harmonizing and merging source mod- els for clip-based domain generalization.arXiv preprint arXiv:2506.09446, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:52.251953Z"},"links":{"cited_paper":"/paper/2506.09446","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:857c82e2479ca575bef066ff113cd74331be956ef4bf4f40be51c304992e1520","observation_id":"f6d345af-7335-4899-a85a-72d1b24c1874","resolution":{"observed_at":"2026-08-03T19:15:52.251953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06305","last_updated":"2020-02-15T02:40:10Z","snapshot_observed_at":"2026-08-07T15:45:43.952318Z","submitted_at":"2020-02-15T02:40:10Z","title":"Fine-Tuning Pretrained Language Models: Weight Initializations, Data Orders, and Early Stopping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06305","snapshot_observed_at":"2026-08-03T19:15:52.462406Z","title":"Fine-tuning pretrained language models: Weight initializations, data orders, and early stopping.arXiv:2002.06305, 2020","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:52.462406Z"},"links":{"cited_paper":"/paper/2002.06305","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:c8b5a057e59d1a2e9d3d63ee26b7d5a940b0fbb7c9ba2e74666220e404f2437b","observation_id":"21fea34f-8013-43e0-a42d-cb2833372c9d","resolution":{"observed_at":"2026-08-03T19:15:52.462406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:52.605455Z","title":"Automatically constructing a corpus of sentential paraphrases","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:52.605455Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:3ea58250df17ffcfa1b08987e49f5d7270ee48171595f46fc8bb8a8139fd9cf2","observation_id":"e046c146-1076-4729-a560-dee117416d40","resolution":{"observed_at":"2026-08-03T19:15:52.605455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:52.747149Z","title":"Task singular vectors: Reducing task interference in model merging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:52.747149Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:c8b0cd23280cd88dde0c1eebb42a4f2c07514650de15598715a9d0b44a897474","observation_id":"7f29518c-dff4-4e75-94d7-1442fab13a4a","resolution":{"observed_at":"2026-08-03T19:15:52.747149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:52.891962Z","title":"The third pascal recognizing textual entail- ment challenge","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:52.891962Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:fa6b1fa206b5b4020d5733be3fcf672f976fee6662dce6da64b75dd4047bf07d","observation_id":"61197950-567a-430a-b54f-b8d35421d587","resolution":{"observed_at":"2026-08-03T19:15:52.891962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:53.067984Z","title":"Gradient reweighting: Towards imbalanced class-incremental learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:53.067984Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:656f846ca45ce31cab930ee719045605b81ad744c1db03bf3aacf510676fff85","observation_id":"a102c5cb-1c8b-4eda-a937-62edccec1e50","resolution":{"observed_at":"2026-08-03T19:15:53.067984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:53.289663Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:53.289663Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:801d6d18ee09420997ddb0cc75342a21e0de4bf6db572b487dff04e54bcf28a1","observation_id":"bf17e717-a55c-4d3b-8fa1-4f7368dc1168","resolution":{"observed_at":"2026-08-03T19:15:53.289663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:53.468921Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:53.468921Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:9b65094214c8c3ecc122fa92e921321afa5fc985b30d64c1017c6505a36a56c3","observation_id":"8f2e8975-5c84-4179-aad9-895c5c93b1a4","resolution":{"observed_at":"2026-08-03T19:15:53.468921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:53.682709Z","title":"Emr-merging: Tuning-free high- performance model merging","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:53.682709Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:15a7dd35be8750db4cc94f4b51deb7d2bcba459efb0b9a4806f4ec2833597540","observation_id":"b357f422-841c-42f5-8dd6-50e3593779be","resolution":{"observed_at":"2026-08-03T19:15:53.682709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:53.885946Z","title":"Multi-granular spatio-temporal token merging for training-free acceleration of video llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:53.885946Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:6f94f35149b6cc4c0f64df0da20e3ed177d3e22b42364ce1f3a1ac510ac4150e","observation_id":"d3b1d99c-8781-4863-8a2e-0550319ebfef","resolution":{"observed_at":"2026-08-03T19:15:53.885946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:54.107569Z","title":"Editing models with task arithmetic","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:54.107569Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:b4882ee36a240baaf817c3fa29f90346d0eda34c62d6360f22cc4f2c9eada66a","observation_id":"c362a8e0-5616-4ef7-9792-5103f5a6c4bc","resolution":{"observed_at":"2026-08-03T19:15:54.107569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:54.303434Z","title":"Pytorch.Programming with TensorFlow: so- lution for edge computing applications, pages 87–104, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:54.303434Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:dbe30069e5c55da4cec009741d7f5fa219f781251dc8a3c15a929006b257c48f","observation_id":"d0af8a09-7bed-4837-922c-46280612bd72","resolution":{"observed_at":"2026-08-03T19:15:54.303434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:54.493367Z","title":"Dataless knowledge fusion by merging weights of language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:54.493367Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:3fd4ee8ffad328adbb29329715d32cb345cf00cc1f3a2392e5bdf1202b54ff17","observation_id":"bd2ce9cb-5cdf-4b88-9cf2-7eb6549eac0c","resolution":{"observed_at":"2026-08-03T19:15:54.493367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:54.780062Z","title":"Repair: Renormalizing permuted activations for interpolation repair","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:54.780062Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:f8cb84f5eefffde7788a8319ca1d931d40af14753c1e5e6cd908bb36a9082b1d","observation_id":"9a456770-13d9-4b6f-bece-974294769e1e","resolution":{"observed_at":"2026-08-03T19:15:54.780062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:54.938422Z","title":"Task vector quantization for memory- efficient model merging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:54.938422Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:e551f47539645970f594017308a94f570a76354713ee523f7e1bde082153c51d","observation_id":"df19c80f-66dc-40ad-abb3-a13669cfc5ee","resolution":{"observed_at":"2026-08-03T19:15:54.938422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:55.125850Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.125850Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:bdf0a762a35704490ddcd96dbb2657a1e52f240e5bc9b69ceb4c6ce6c82f8390","observation_id":"f3544bb3-a802-40fa-bb4c-c797cdc0f16e","resolution":{"observed_at":"2026-08-03T19:15:55.125850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:55.215038Z","title":"Singular value decompo- sition.Numerical analysis for statisticians, pages 129–142,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.215038Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:b13ac8eb3662f4d9abbc06d241af679cb4bc455d0fdee8148735ad96af45ee04","observation_id":"7052d903-a01a-474d-b5a8-9058ffcca397","resolution":{"observed_at":"2026-08-03T19:15:55.215038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:55.302483Z","title":"Mitigating parameter interference in model merging via sharpness-aware fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.302483Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:e7c13c70a350d8257550aea7a8a42c78788dddf9097bd9513593ff538014521e","observation_id":"05e070d1-56fd-4993-a159-eabed10295ab","resolution":{"observed_at":"2026-08-03T19:15:55.302483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:55.383126Z","title":"Map: Low-compute model merging with amortized pareto fronts via quadratic approximation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.383126Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:17179ad7959a51f0028b3dd506a6cf903b79dc826b8dbc4744d3163e7780d741","observation_id":"034a1d56-e3f8-4bc8-bbcf-13b1e5d92356","resolution":{"observed_at":"2026-08-03T19:15:55.383126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:55.407891Z","title":"Model merging in pre-training of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.407891Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:96ce7556d77d17f80319befaa974796db26225871a14ebc66d8c9e5d97686b02","observation_id":"52a0132b-2b31-4174-840b-1bfec81a6453","resolution":{"observed_at":"2026-08-03T19:15:55.407891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:55.473559Z","title":"Truthfulqa: Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.473559Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:a995ff12234d8c58179862248e7f77606e65ed5f4d16de0e367a6f20163f8c5d","observation_id":"1e4bced3-f827-4dee-9c27-6dcdab66b936","resolution":{"observed_at":"2026-08-03T19:15:55.473559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10743","last_updated":"2025-05-23T02:52:05Z","snapshot_observed_at":"2026-07-06T20:37:05.273140Z","submitted_at":"2025-02-15T09:47:50Z","title":"1bit-Merging: Dynamic Quantized Merging for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10743","snapshot_observed_at":"2026-08-03T19:15:55.592279Z","title":"1bit-merging: Dynamic quantized merging for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.592279Z"},"links":{"cited_paper":"/paper/2502.10743","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:ebb0b8a195acad23a3d4a09ca1889fc79d5f94e97c4828bad5cf95c221be6ccd","observation_id":"92ec3d1a-a429-409a-8b34-d11440dd8b04","resolution":{"observed_at":"2026-08-03T19:15:55.592279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-03T19:15:55.722729Z","title":"Roberta: A robustly optimized bert pretraining approach.arXiv:1907.11692, 2019","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.722729Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:fa7f8cda33a21ca8d7d16068e1a7766a637e5e55dfe34a0bb87beda5b61ea5b9","observation_id":"9c8dc007-c3d1-458d-bd2c-f43bb78300bf","resolution":{"observed_at":"2026-08-03T19:15:55.722729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:55.843459Z","title":"Twin-merging: Dynamic integration of modular expertise in model merging","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.843459Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:f7d1d8385fee8979fbe3f15cac7b38b468e242395be8be0d07a8120bfaf6ff6b","observation_id":"d5af9a1b-a5b7-4cf3-8ce2-718930b74d08","resolution":{"observed_at":"2026-08-03T19:15:55.843459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:55.993993Z","title":"No task left behind: Isotropic model merging with common and task-specific subspaces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:55.993993Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:57378d6e5b1071f49a414130913b868e3ff7eb8647d2ef69fbfeac3bce2817a3","observation_id":"a11c0d9d-1620-497e-bd79-55f369567d98","resolution":{"observed_at":"2026-08-03T19:15:55.993993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:56.131288Z","title":"Merging models with fisher-weighted averaging","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.131288Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:85d82c1913ed6242960ba2dae85c807e6624c7ee8814dd25548ba80fe96fd021","observation_id":"498a2ceb-3d32-492d-ae8f-88f4761b69d2","resolution":{"observed_at":"2026-08-03T19:15:56.131288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03745","last_updated":"2024-05-13T16:20:29Z","snapshot_observed_at":"2026-07-06T15:39:14.565475Z","submitted_at":"2023-06-06T15:04:31Z","title":"Soft Merging of Experts with Adaptive Routing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03745","snapshot_observed_at":"2026-08-03T19:15:56.279870Z","title":"Soft merging of experts with adaptive routing.arXiv:2306.03745,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.279870Z"},"links":{"cited_paper":"/paper/2306.03745","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:b2fe02091c093653898d2bd6f93ebf5a5498c5bda3dbd99b40b2099507e0391c","observation_id":"c03961da-b987-40f1-bdb4-91d93cbc3706","resolution":{"observed_at":"2026-08-03T19:15:56.279870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:56.365931Z","title":"Reading digits in natural images with unsupervised feature learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.365931Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:4df5ec979c2859284eaa6a136b63fdf24783e0dfbd8198557bceedbebb31b171","observation_id":"d8879641-fd29-461b-b695-df044e42c017","resolution":{"observed_at":"2026-08-03T19:15:56.365931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:56.476943Z","title":"Dawin: Training-free dynamic weight interpolation for robust adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.476943Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:50bf8da6e8d13990b4271e40531e2c4e6ecd48d18ff449b9effec9cd12df8e4a","observation_id":"729470e4-0a3d-43f8-b2ef-70fcd5d70d4a","resolution":{"observed_at":"2026-08-03T19:15:56.476943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:56.604743Z","title":"Accurate and efficient low-rank model merging in core space","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.604743Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:248a9338ff61163c13bc50c1f52483bff2647165ad33f1b2b28021c8a5c15f7f","observation_id":"a3a5bdce-b087-418c-b5f2-92d9a423c79b","resolution":{"observed_at":"2026-08-03T19:15:56.604743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:56.685292Z","title":"Bbq: A hand-built bias benchmark for question answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.685292Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:9ab0a7fd56727cdc4d85c1126efbc931d7ee07cc9c74b46f3954764729ac31df","observation_id":"3476cbb8-6728-4f84-8c35-0be6f294bf3c","resolution":{"observed_at":"2026-08-03T19:15:56.685292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:56.744947Z","title":"Less is more: Efficient model merging with binary task switch","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.744947Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:e70d7dc949ff8be20d6da9234f9efbd2cc5614cea239b241f4c696b4a0beb8a5","observation_id":"bb995de4-9539-408f-bfdf-8733495f60c9","resolution":{"observed_at":"2026-08-03T19:15:56.744947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:56.862391Z","title":"Mingle: Mixtures of null- space gated low-rank experts for test-time continual model merging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.862391Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:203cae927aecb2200f297db4523fd6991c275adeee27635e23f983d564f90985","observation_id":"c0fbedc3-a5b0-42a7-99ff-81e9cbcbe405","resolution":{"observed_at":"2026-08-03T19:15:56.862391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:56.948299Z","title":"Language models are unsuper- vised multitask learners.OpenAI blog, page 9, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:56.948299Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:b345a11b19030632cc540751807ecefd453b335221bccf02db7c953a646ea83b","observation_id":"ff65d78c-2bee-4ad8-889f-6c85b7262052","resolution":{"observed_at":"2026-08-03T19:15:56.948299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:57.071460Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:57.071460Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:a4b7410f4e8f16592a5f80f9bab7696e76ad42f8f82667ec5b6284fa48052bf0","observation_id":"cae3866d-f1c6-4bc6-b408-f0faaadf5531","resolution":{"observed_at":"2026-08-03T19:15:57.071460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:57.194051Z","title":"Squad: 100,000+ questions for machine comprehen- sion of text","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:57.194051Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:9a983ccbf4e03e0785c7ca6caea13f6db8cd08096e3283dbbec9e8e0d73c83ca","observation_id":"1239da18-ec36-4d92-b49a-137665d5485f","resolution":{"observed_at":"2026-08-03T19:15:57.194051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:15:57.670437Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T19:15:57.670437Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:7e29e09241d0e7f989250ecd52f9f0d794482949e9455cfe863f879909709692","observation_id":"4ede5230-228f-4063-8972-68ede2ebd725","resolution":{"observed_at":"2026-08-03T19:15:57.670437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:00.424362Z","title":"The german traffic sign recognition benchmark: a multi-class classification competition","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:00.424362Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:5e9771df67d93eae396f76378663c659f5bd95f38219fd1c3de096d0fc43bf5a","observation_id":"66839cdb-60ed-45e8-a490-1e2813a7af8c","resolution":{"observed_at":"2026-08-03T19:16:00.424362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:00.610131Z","title":"Model merging with svd to tie the knots","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:00.610131Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:4c06f4128f15434a4d26fe9be5f52c3307fe5511e91d6adbce3f41fb72630159","observation_id":"6c41d9eb-5b8d-470f-a2a8-86f12c8bc214","resolution":{"observed_at":"2026-08-03T19:16:00.610131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:00.740601Z","title":"Cat merging: A training-free approach for resolving conflicts in model merging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:00.740601Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:ee70682db0a243ecd11cac30f606d156146f9f916b55b0155073a965ce8671e5","observation_id":"b0d80eb1-baa0-43da-865e-fd4491aae670","resolution":{"observed_at":"2026-08-03T19:16:00.740601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:00.934327Z","title":"Towards minimizing feature drift in model merging: Layer-wise task vector fusion for adaptive knowledge integration.arXiv preprint arXiv:2505.23859,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:00.934327Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:dcbe1c7dca83b0a6ab5a79654475be7a9195582cdfcf8ae6e331fe25876a60f2","observation_id":"942444c8-e662-4279-88a3-4195dc3c13f3","resolution":{"observed_at":"2026-08-03T19:16:00.934327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:01.093238Z","title":"Merging multi-task models via weight- ensembling mixture of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:01.093238Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:c59bf22ddf8847abac0535bd62fa4577182621bec2b2f5541b67fdf9f8a83daf","observation_id":"c71481e9-568d-47cb-991c-56ef88ffa65a","resolution":{"observed_at":"2026-08-03T19:16:01.093238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-03T19:16:01.278500Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:01.278500Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:74acbce3a4cc5f918ccf56a0ff0e5fe0bb47ba5242533c7875daf7485348a5ec","observation_id":"34a8f182-8956-474d-b488-b29f84db6d57","resolution":{"observed_at":"2026-08-03T19:16:01.278500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:01.486664Z","title":"Glue: A multi-task benchmark and analysis platform for natural language under- standing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:01.486664Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:dd333ecf53c85aebae2ea95454054ff4a7b677e716abe58adfc17381504e2469","observation_id":"0cd60987-ede8-4b61-ab43-71b38f175ec0","resolution":{"observed_at":"2026-08-03T19:16:01.486664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:01.696081Z","title":"Localizing task infor- mation for improved model merging and compression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:01.696081Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:638fb68de97505c031ddcf35b1201ede812fef0e66230b972afa8c47bbe5336a","observation_id":"8150e4dd-4c6e-4f5f-869b-0df38ca90866","resolution":{"observed_at":"2026-08-03T19:16:01.696081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:01.794790Z","title":"Neural network acceptability judgments","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:01.794790Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:d65906a8ebe81e511b26f9ae15d43871c7b0a3ed8d0bad64950fcd08458bad82","observation_id":"51ee11c9-64d8-49d0-896a-aff217c76fd7","resolution":{"observed_at":"2026-08-03T19:16:01.794790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:01.935010Z","title":"A broad-coverage challenge corpus for sentence understanding through inference","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:01.935010Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:8dc84da7a2d6d1e35b2825f2c2909612f88ef0f83f8747389ca737c2073f339e","observation_id":"c30a9d63-26a5-46d9-8e7b-75a06c9735f5","resolution":{"observed_at":"2026-08-03T19:16:01.935010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-03T19:16:02.135379Z","title":"Huggingface’s transformers: State-of-the-art natural language processing","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:02.135379Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:ffb48fdaa7418c053b04e3f7e1318bb965349d3849f675690cab99dd0a505006","observation_id":"174a7012-9e9d-42ff-bbec-9149ee20cd49","resolution":{"observed_at":"2026-08-03T19:16:02.135379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:02.337074Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing in- ference time","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:02.337074Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:c09130cedec5372440fd1a9c150b927b9a7d58b253131c4d021e75aa642ed5f2","observation_id":"f240e85c-23a1-46eb-a660-daebd06cbf52","resolution":{"observed_at":"2026-08-03T19:16:02.337074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:02.523080Z","title":"Importance-based token merging for efficient image and video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:02.523080Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:3af30a10ff0d61a741dbaabe42ceb3f6c898e0329ecd7b63f7c9c2b0ed180e81","observation_id":"c2d1c4e4-f8f6-4354-a062-694e60ca61ea","resolution":{"observed_at":"2026-08-03T19:16:02.523080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:02.757883Z","title":"Sun database: Large-scale scene recog- nition from abbey to zoo","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:02.757883Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:d411a2c81adfa2da3c0a41566aa5a2c1e5e430460ce25edf372b4911b601c2b3","observation_id":"213a6f0b-0eb5-4db6-80a5-c72eca9ced60","resolution":{"observed_at":"2026-08-03T19:16:02.757883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:02.851393Z","title":"Ties-merging: Resolving interference when merging models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:02.851393Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:6725a900e4504eafa3ffed88af2b25bf4ebd594dc93a880fad8806efa90d286e","observation_id":"391f56a8-5815-4c73-a63d-cd86b227854e","resolution":{"observed_at":"2026-08-03T19:16:02.851393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.006217Z","title":"Calm: Consensus-aware localized merging for multi-task learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.006217Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:655b5d40c56d10282b6e4cc5d5bb35c7108f24067e4ad8f2818abe6c22bde10b","observation_id":"2b213b1d-01f6-4ef9-968e-152d905452f2","resolution":{"observed_at":"2026-08-03T19:16:03.006217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.094983Z","title":"Adamerging: Adap- tive model merging for multi-task learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.094983Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:1952964015858c8ed67994e89ad2096af74e3a316ede998e23dac80887320e30","observation_id":"3622a0a5-e684-444d-b872-5a7c0238e7ce","resolution":{"observed_at":"2026-08-03T19:16:03.094983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.188200Z","title":"Continual model merg- ing without data: Dual projections for balancing stability and plasticity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.188200Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:ce332fc9ebd1fd0b511c4906108e2aac7a155a356d9ddd7c464fedde619503f6","observation_id":"67bf4f89-086c-440e-81db-4a6f8af8f7f0","resolution":{"observed_at":"2026-08-03T19:16:03.188200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.244174Z","title":"Mix data or merge models? balancing the helpfulness, honesty, and harmlessness of large language model via model merging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.244174Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:70ad63425fa778e359de70e3affb38a18771f1eaf4a2f60ab3be4fedd7520b3e","observation_id":"4396b531-c3f7-4eeb-8c30-25a36dfc386c","resolution":{"observed_at":"2026-08-03T19:16:03.244174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16240","last_updated":"2023-12-25T09:32:28Z","snapshot_observed_at":"2026-07-06T17:08:17.073060Z","submitted_at":"2023-12-25T09:32:28Z","title":"Merging Vision Transformers from Different Tasks and Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16240","snapshot_observed_at":"2026-08-03T19:16:03.288029Z","title":"Merg- ing vision transformers from different tasks and domains","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.288029Z"},"links":{"cited_paper":"/paper/2312.16240","citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:66ba2d05dc0ae6be3e5fd8333c5a92e1727248c2c907e35a35ffcbe7b73f1692","observation_id":"be94f38f-ed2a-4a70-b9de-248fdc155acf","resolution":{"observed_at":"2026-08-03T19:16:03.288029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.380629Z","title":"Language models are super mario: Absorbing abilities from homologous models as a free lunch","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.380629Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:5eb9dafb3dcb414b20da46e393457e0bd87ef56e6a3e60a953bd29ba9eb11bdf","observation_id":"348c52c8-9e30-4b41-8a50-24c8f186c4d4","resolution":{"observed_at":"2026-08-03T19:16:03.380629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.483210Z","title":"Robustmerge: Parameter-efficient model merging for mllms with direction robustness","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.483210Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:ffab0221a284aa8007a88a9a3477409cb23cbeafc3eed1dbe01c603cff665b6c","observation_id":"7977c72d-a9ab-4e34-bd37-56107e8bc9b8","resolution":{"observed_at":"2026-08-03T19:16:03.483210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.635239Z","title":"An overview of multi-task learn- ing.National Science Review, pages 30–43, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.635239Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:4aad2d17c330dfce59e3c6cd2773b67c8de8dfba9bae27636a93d8f36ac39f6a","observation_id":"9e70b426-2ff4-490b-99b5-ee44a0eeda04","resolution":{"observed_at":"2026-08-03T19:16:03.635239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.727047Z","title":"A survey on multi-task learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.727047Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:d245d20f18ab1b7ff673576085c88fbdbc7d17f6107201e14014c09b55a9ec0b","observation_id":"1b00b4b1-9c16-4e57-bb62-7c766c93ea30","resolution":{"observed_at":"2026-08-03T19:16:03.727047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.810134Z","title":"Beyond training: Dynamic token merging for zero-shot video understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.810134Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:6795a9749b0636c577989b095c05a5d0933205a2cf8d73ee012c9a3f51d6bc5f","observation_id":"e2ac7eb7-36e6-482f-9c40-d6155dbbcff3","resolution":{"observed_at":"2026-08-03T19:16:03.810134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.870473Z","title":"Merging loras like playing lego: Pushing the modularity of lora to extremes through rank-wise clustering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.870473Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:93ca316ff1f68ee7ff740277c1721f31ec4c86c28eca5a89b9071ddef515c0d6","observation_id":"b2795d49-68cf-499e-a7f1-89948d08566e","resolution":{"observed_at":"2026-08-03T19:16:03.870473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:03.988962Z","title":"Free-merging: Fourier transform for efficient model merging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:03.988962Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:5c0fc8cacfc53f22040cd9ef25e0d895553fdad0b68b90af95e71b60a569e962","observation_id":"37368d30-7f3f-467c-b41c-a382c461aa48","resolution":{"observed_at":"2026-08-03T19:16:03.988962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:04.061770Z","title":"Aim: Adaptive inference of multi-modal llms via token merging and pruning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:04.061770Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:226e795b9dede98811db043c9aa46ffd3e18965140ddcddd9119fca70c020766","observation_id":"5487cd89-048c-4cf7-b44c-597ac5832bb2","resolution":{"observed_at":"2026-08-03T19:16:04.061770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:04.245221Z","title":"Metagpt: Merging large language models using model exclusive task arithmetic","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:04.245221Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:e0434b4d1cf041f1ad5d217201a303216145d2b74ad5a2ecc310db20bb5f7cd4","observation_id":"2556686e-7b97-4b14-8979-60530e573964","resolution":{"observed_at":"2026-08-03T19:16:04.245221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:04.347407Z","title":"Hm3: Hierarchical multi-objective model merging for pretrained models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:04.347407Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:a5c3f53b460fd115f8924d063fbd6f7b2c747494836e4fb008838b80cd14f4ae","observation_id":"b8094bb2-fba1-41df-a3e1-caa9fa85152a","resolution":{"observed_at":"2026-08-03T19:16:04.347407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:04.534741Z","title":"Remedy: Recipe merging dynam- ics in large vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:04.534741Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:91c608b4b89e38d08fae2f27e4349f4d595803af8eb26b5d185a00d6e999d2c9","observation_id":"7d5aa789-7c83-4f32-9390-a487750bfb51","resolution":{"observed_at":"2026-08-03T19:16:04.534741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:04.715412Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:04.715412Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:0d25a66f6cc0529dd33d633c5d50bf61282f518ee503e599081cfed11e968489","observation_id":"b6b1bc46-69fc-4454-a575-24f6745b782f","resolution":{"observed_at":"2026-08-03T19:16:04.715412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:04.812594Z","title":"Baselines for seen tasks • Individual Modelsrefer to task-specific models before merging","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:04.812594Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:c2fc4a6e5bbaaa30a0611f87b018de8305c7aede08950a6c9bbb290ce8b421a2","observation_id":"cbd15223-86e5-4f2b-89b9-df7d0cda9260","resolution":{"observed_at":"2026-08-03T19:16:04.812594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:04.883595Z","title":"Datasets For visual classification tasks, we employ classification accu- racy as the evaluation metric","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:04.883595Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:7b14e7a2fa12203e90493024f8797d6311e056b9e73876e978dbe031b9c8866f","observation_id":"3e61ff90-deff-4d4c-ae97-874850397e29","resolution":{"observed_at":"2026-08-03T19:16:04.883595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:16:04.999697Z","title":"More Backbones In addition to the backbones evaluated in the main paper, we also assess the performance of various methods on ViT-B/16, ViT-L/14, and GPT-2 backbones","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:04.999697Z"},"links":{"citing_paper":"/paper/2512.01461"},"observation_digest":"sha256:24c9a8aa32d91fdbbf88fa593e4e4c5c7484bb94edd3fa68dd76a7970a2d9f4f","observation_id":"d3158880-0e22-4ba3-b934-41709a028a37","resolution":{"observed_at":"2026-08-03T19:16:04.999697Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.01461","last_updated":"2026-06-29T13:53:53Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T19:15:49.270551Z","submitted_at":"2025-12-01T09:47:17Z","title":"Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":81,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 2 inbound Pith citation observations for arXiv:2512.01461."}