{"as_of":"2026-08-08T04:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a869d2bad7deefd0115eeab2eebf81c916037e2672973e268d46485299a45e7","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:11:00.632589Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:52:10.770345Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T08:56:02.699251Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"cited_work":{"arxiv_id":"2506.09093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Merging smarter, generalizing better: Enhancing model merging on ood data","venue":null,"work_id":"36fd77af-a241-4b6a-9108-4cc62f94727f","year":2025},"citing_paper":{"arxiv_id":"2604.06440","last_updated":"2026-04-07T20:28:24Z","snapshot_observed_at":"2026-08-04T19:54:31.349994Z","submitted_at":"2026-04-07T20:28:24Z","title":"Visual prompting reimagined: The power of the Activation Prompts","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-05-10T18:52:10.770345Z"},"links":{"cited_paper":"/paper/2506.09093","citing_paper":"/paper/2604.06440"},"observation_digest":"sha256:97deddeb41afe7249fdd859964ff93a98faf376d985ad06295ffc19c4e7fb998","observation_id":"02f67b41-7490-4d75-9b71-a075d3064af0","resolution":{"observed_at":"2026-05-10T23:45:54.031019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"cited_work":{"arxiv_id":"2506.09093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Merging smarter, generalizing better: Enhancing model merging on ood data","venue":null,"work_id":"36fd77af-a241-4b6a-9108-4cc62f94727f","year":2025},"citing_paper":{"arxiv_id":"2604.10074","last_updated":"2026-04-11T07:46:15Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T07:46:15Z","title":"Transformers Learn the Optimal DDPM Denoiser for Multi-Token GMMs","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-10T16:23:50.751356Z"},"links":{"cited_paper":"/paper/2506.09093","citing_paper":"/paper/2604.10074"},"observation_digest":"sha256:48b45f60e4e9e97a6156d3dd40523d0d6ba612d79e3b59d5a12618d161d4121a","observation_id":"40695ac9-1d13-4cb6-bdbc-6fb93b2b7d59","resolution":{"observed_at":"2026-05-11T08:56:02.704782Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09093/citation-record","integrity":"/paper/2506.09093/integrity","json":"/paper/2506.09093/citation-record.json","paper":"/paper/2506.09093"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.537040Z","title":"Git re-basin: Merging models modulo permutation symmetries","venue":null,"work_id":"117f0e03-9b71-4225-b020-0cf124d6fc55","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.364767Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:6093c179716232e338c9b8b6034983ebf4655355ec1a8633cdb626ce5b67b43b","observation_id":"d60fb19a-0d9c-4111-991c-b245b63e4126","resolution":{"observed_at":"2026-08-07T05:11:01.541074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.525158Z","title":"Merging multi- task models via weight-ensembling mixture of experts","venue":null,"work_id":"fb30e274-594e-4fbf-b157-0f80adc9e168","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.369012Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:11d7069e4e20f015743e869568bcdbfee1e206675e4db7529adf0a0bb1a246a1","observation_id":"62034c3e-8160-4758-9345-b59dc67911a6","resolution":{"observed_at":"2026-08-07T05:11:01.529625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.512110Z","title":"Types of out-of-distribution texts and how to detect them","venue":null,"work_id":"b958d0a9-9893-4842-b4e8-9ed483026fba","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.372850Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:764b61c7d2163d7ec2a874bee7578a957c59e26e5b5a7ff0848fea094514befe","observation_id":"2fbc8b99-ecac-4a48-ac72-2c105fe0d212","resolution":{"observed_at":"2026-08-07T05:11:01.515926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T05:11:00.376272Z","title":"On the opportunities and risks of foundation models.arXiv preprint arXiv:2108.07258, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.376272Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:e0fa090d05b273154d7cdfc55a80466036235dd32f060c4c78a8723946d055d0","observation_id":"e2a78cc7-3d89-455f-841d-4663ca0a69f2","resolution":{"observed_at":"2026-08-07T05:11:00.376272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.500836Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":"79d6046c-3050-42a2-abb9-003776255545","year":2014},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.380521Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:6e529202976c29b798784f5adc1455e2d8e51784c3dcea3b2ea0485daa67837f","observation_id":"ac0fc2fd-637b-429f-b513-9f84dfd7a813","resolution":{"observed_at":"2026-08-07T05:11:01.505037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.490038Z","title":"Swad: Domain generalization by seeking flat minima","venue":null,"work_id":"d5e17f2f-df96-4198-9216-1113f51e3a4b","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.383776Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:4b6f114208a783add0278ac1408fa28540d697e8c184d68cee5eb8058081a96f","observation_id":"03be2873-8636-4762-9eff-d9649327b124","resolution":{"observed_at":"2026-08-07T05:11:01.493812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.477823Z","title":"Fine-tuning deteriorates general textual out-of-distribution detection by distorting task-agnostic features","venue":null,"work_id":"7992bee6-bea3-4b18-b734-f08fa734ac6c","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.387529Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:70724bdbf02fa65f164d196dcd1926a805cb1caa2a125e181c09af53c1f0d838","observation_id":"85ac2651-a858-4d04-92d3-0e324e6b1a22","resolution":{"observed_at":"2026-08-07T05:11:01.481821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.466601Z","title":"The principle of diversity: Training stronger vision transformers calls for reducing all levels of redundancy","venue":null,"work_id":"9c6cfe8d-3e30-4153-beb1-6b8de82dcb91","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.390859Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:8b660d0300c454c27b601f82339d8037db774cf7632f4c71569ef36c187f3589","observation_id":"da00ae37-de49-410e-b815-97d93be58a81","resolution":{"observed_at":"2026-08-07T05:11:01.470480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.394211Z","title":"Remote sensing image scene classification: Benchmark and state of the art.Proceedings of the IEEE, 105(10):1865–1883, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.394211Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:3d7da515bc668233e656e8ce2d061c2fe0d091df3869bbbba82ced74d45f4c64","observation_id":"181ea70b-0f66-4b02-ac8a-d9a95437186c","resolution":{"observed_at":"2026-08-07T05:11:00.394211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.449358Z","title":"Describing textures in the wild","venue":null,"work_id":"33a438cc-d6ba-4e91-a570-466dbb3aa7fb","year":2014},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.398247Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:714e1ceabb5f6bdb016daf45690548a1f4d94adc091de2a8fd12e902d42b5ec2","observation_id":"8b8bb5c1-564f-4162-be06-dac278d07fcf","resolution":{"observed_at":"2026-08-07T05:11:01.453335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01718","last_updated":"2018-12-03T12:37:31Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T12:37:31Z","title":"Deep Learning for Classical Japanese Literature","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01718","snapshot_observed_at":"2026-08-07T05:11:00.401847Z","title":"Deep learning for classical japanese literature.arXiv preprint arXiv:1812.01718, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.401847Z"},"links":{"cited_paper":"/paper/1812.01718","citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:e16a64308ee7dced4b70ca45cb659ded04c98f8ca5949813b7652f6d361a2b5f","observation_id":"c8ecc072-ba93-44e1-96b9-aaa95b3ba17a","resolution":{"observed_at":"2026-08-07T05:11:00.401847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.438416Z","title":"An analysis of single-layer networks in unsuper- vised feature learning","venue":null,"work_id":"150f5238-2fdb-4981-a7e1-b3bdf12b5147","year":2011},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.405698Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:69a34bf600ba8cd3c50ac82bef582c50d3541c25140630d25733d3d6c63f722c","observation_id":"0ded63f6-8a33-40dc-9e86-ead9c5ba295f","resolution":{"observed_at":"2026-08-07T05:11:01.442107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.427783Z","title":"Emnist: Extending mnist to handwritten letters","venue":null,"work_id":"ee1c983f-b72d-4537-b0dc-77898d3afcb3","year":2017},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.408995Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:8d020aa09004f26b88143aa33fea9d8e654b4be6d087967d67fbfa9d70ae830e","observation_id":"30272285-9af9-4b24-aeef-a22b5f950029","resolution":{"observed_at":"2026-08-07T05:11:01.431564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.416625Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"639eb9f5-e516-4461-b9ef-3fc97b5ea5fa","year":2009},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.412213Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:3c35d422c52d8127bd24348922b9a3739a0babb139d8d680fdba6fb8ae5c6f7d","observation_id":"bd746055-6b60-4db1-9416-ba79347af7bb","resolution":{"observed_at":"2026-08-07T05:11:01.420670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.415335Z","title":"The mnist database of handwritten digit images for machine learning research [best of the web].IEEE signal processing magazine, 29(6):141–142, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.415335Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:dd2ed8a6fb3b8d040eee23e5de0c93362ed72b32fbe3462f776947ed568b9d1e","observation_id":"e1d41e7e-6959-42c5-8a45-831cec250c82","resolution":{"observed_at":"2026-08-07T05:11:00.415335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.400118Z","title":"Merging by matching models in task parameter subspaces.Transactions on Machine Learning Research, 2024","venue":null,"work_id":"7d1607a0-452b-41e3-a109-bc3b20956190","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.418668Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:2ec5b1e98ab0965a9b01015959151081b7d0bd7ff7bcae11bd933da4216092d5","observation_id":"89cb91ef-e407-48ba-90b8-8eff0fbfe4ef","resolution":{"observed_at":"2026-08-07T05:11:01.403969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.388772Z","title":"Qlora: Efficient fine- tuning of quantized llms","venue":null,"work_id":"31521437-74d0-482e-805c-f7c3cbb15799","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.422183Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:19505539c7eb890ef5bd3ca905f3a810fe62e04c8d39054f776f62b2cdd06806","observation_id":"309d8e6e-3b63-469c-a47f-4179ce61394b","resolution":{"observed_at":"2026-08-07T05:11:01.392538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.377958Z","title":"Revisiting large language model pruning using neuron semantic attribution.arXiv e-prints, pages arXiv–2503, 2025","venue":null,"work_id":"3b923892-f94f-4224-89c0-b7848a8f3608","year":2025},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.425458Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:45f1af51497790b591a4d82e175f16b0cacbeb7a22216186b389b467e482fe95","observation_id":"d5677380-fc0e-41b3-8fd6-253224a0f9cc","resolution":{"observed_at":"2026-08-07T05:11:01.381688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.428871Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.428871Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:592351b920d3e3fe1f1e9d9e0fdcfea4e9c15de8486207dd24473fee8c355bbd","observation_id":"26fbc9ef-ad4f-421b-8c4a-24f5e4f559f7","resolution":{"observed_at":"2026-08-07T05:11:00.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.360339Z","title":"Parameter competition balancing for model merging","venue":null,"work_id":"866dc0f2-fd5a-4d6d-8dc8-2487d7792f5b","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.432177Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:2fa243c5e239ac1ea57d0aaedcb016c664e6df2f130977dc64b2d756247b3380","observation_id":"ffd81db5-c8ce-476d-a45f-67dd847abbbd","resolution":{"observed_at":"2026-08-07T05:11:01.364132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.350188Z","title":"Memorization vs","venue":null,"work_id":"02c67283-f4a2-43b5-a214-7fdf3c9c8dff","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.435504Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:4616627445564d7c6bcab8abe3679709ce6ede04796e21ec41c959eb0eb2d226","observation_id":"0258cd30-cef3-4379-ba10-317432b2e29c","resolution":{"observed_at":"2026-08-07T05:11:01.353743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.339772Z","title":"Efficiently identifying task groupings for multi-task learning","venue":null,"work_id":"5ca7e781-25a5-4a16-bdc4-7ab203c601a2","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.438869Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:f475ffc59db787fc082269ad28a8c67160e45e9fc9cd3c9ed0d76f1ee027dbfd","observation_id":"6154c5d3-0704-4544-9804-1c3fbf1f20c1","resolution":{"observed_at":"2026-08-07T05:11:01.343647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.329319Z","title":"Challenges in representation learning: A report on three machine learning contests","venue":null,"work_id":"4f89449f-fa17-4c08-93ec-9050dd752d77","year":2013},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.442128Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:430690bec49904e7d8a3439040c2506b6d082df0a2bd7c1ff1e95aedaecd28e5","observation_id":"4d30b5e7-53fd-4bf1-94c8-15862c4a1b56","resolution":{"observed_at":"2026-08-07T05:11:01.332980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.319070Z","title":"Stochastic weight averaging in parallel: Large-batch training that generalizes well","venue":null,"work_id":"81e4fe2d-c52b-4de0-8bc7-152cd92504f4","year":2020},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.446147Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:2deca0e8d90a30ceee1fad5943918abe3b3474edf0f613694f858fab8a522509","observation_id":"b876ee4c-c4e2-4482-8a7a-01c9935c9036","resolution":{"observed_at":"2026-08-07T05:11:01.322783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.449212Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.449212Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:57834316e8044f9419392446906e49af2cfed1ef6d6d36bb79f22960864c8c4e","observation_id":"3288905a-9f62-4d52-9ade-cefc0880db44","resolution":{"observed_at":"2026-08-07T05:11:00.449212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.302282Z","title":"Multi-dimensional model compression of vision transformer","venue":null,"work_id":"be62e5f5-d20d-4797-b095-f82901526392","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.452407Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:c93f934d1a31939acbb478f77348f8bbf916a4b04492aa90a6bf4da2f30300e2","observation_id":"30715ba0-381a-43eb-af21-f7179d9127e9","resolution":{"observed_at":"2026-08-07T05:11:01.306129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.291608Z","title":"Editing models with task arithmetic","venue":null,"work_id":"f9ed44cf-95c6-4664-a0ba-5b6c39d125ff","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.456136Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:5acbf3b50f6f8c82054a1f22440d5a4de14e17aa852075391724d3054edf58c4","observation_id":"086a0e5e-abbb-4f43-8ef3-adfca66e9090","resolution":{"observed_at":"2026-08-07T05:11:01.295483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.279613Z","title":"Model stock: All we need is just a few fine-tuned models","venue":null,"work_id":"59dcf485-f4ae-4bd5-af23-7d2af9b8061b","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.459447Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:914ec08c86ec52b3691233f1b170716a7f27254ad4c7f316e7e1859cdb8bb1c3","observation_id":"d8e4e494-410d-4f4b-8f56-2c5aa73741bd","resolution":{"observed_at":"2026-08-07T05:11:01.283378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.269544Z","title":null,"venue":null,"work_id":"b49fd711-f61e-4687-88dc-7aa46f137b7d","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.463525Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:f6db444808b7dcbbdc5e7b794dbfb736164cd8be04c5ef9f251935960bbd40e6","observation_id":"c10ff42b-2484-464d-a3d3-0ae8972c86c8","resolution":{"observed_at":"2026-08-07T05:11:01.272949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.257649Z","title":"Dataless knowledge fusion by merging weights of language models","venue":null,"work_id":"7dcbbc76-59d2-46a8-8715-52657dcd6812","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.467000Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:9d8351483157c1e90c383bdd3ced09cb69ffe7667e17cd9d924688287535034e","observation_id":"2192e3c1-3629-47d2-ba78-4de3a49b7bed","resolution":{"observed_at":"2026-08-07T05:11:01.262878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.247177Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"60a65c06-58d6-4825-8a83-95a5ac66cf7e","year":2019},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.470208Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:981390a993cf0456d87b5d0f71d6664fe4d2de2d5d08342a3bf913915db8c829","observation_id":"11599d77-751e-4d63-89a7-683f81530240","resolution":{"observed_at":"2026-08-07T05:11:01.250881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.234775Z","title":"3d object representations for fine- grained categorization","venue":null,"work_id":"331e33f6-96b4-4d66-8fcf-e708d4b45a6c","year":2013},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.473429Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:dd2227f7d234448270bfe516aa492aa0c70022838e4e0ea4b22b809fc4075dc5","observation_id":"7ba6ac68-af0b-406b-8c64-997ce83e3006","resolution":{"observed_at":"2026-08-07T05:11:01.240559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.476471Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.476471Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:99a9c1601e7e31055cc0f85b64244d23be686e4f4282ef27b3a8866910989e85","observation_id":"52e083d3-79bc-48c1-b935-d634c503d796","resolution":{"observed_at":"2026-08-07T05:11:00.476471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.215226Z","title":"Fine-tuning can distort pretrained features and underperform out-of-distribution","venue":null,"work_id":"7406c9af-3bb7-4364-b715-49772130a674","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.479736Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:45053d9c79c6843a49e902180e638814afd03fe5e969edeb7c353609fe182aeb","observation_id":"5182d8f3-8fb1-47f7-9135-ca43f1194533","resolution":{"observed_at":"2026-08-07T05:11:01.219748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.203733Z","title":"Question and answer test-train overlap in open-domain question answering datasets","venue":null,"work_id":"3ba34e2e-fb75-4143-bde4-71e6348b6ab9","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.483748Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:0f806e3f2f67a17788cd61b02b62015145bd1480a8a6c3d66dd69ec8741e5ea7","observation_id":"21019bf5-0188-4d8e-b969-e6bd60806c91","resolution":{"observed_at":"2026-08-07T05:11:01.207742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.193883Z","title":"A theoretical understanding of shallow vision transformers: Learning, generalization, and sample complexity","venue":null,"work_id":"1c2ca7b8-118f-4f67-afc9-ae8189bae976","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.486903Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:ca94ccc63fbc5d8405fb2558ce0f58f77fe9d5c50464a330d59c2314ff81c1ab","observation_id":"279629a4-3479-49b0-b43a-a5ded2ba2529","resolution":{"observed_at":"2026-08-07T05:11:01.197424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.184055Z","title":null,"venue":null,"work_id":"53d202c8-87c2-4a12-b0d1-ec0e8a569fdf","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.490266Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:09fc7dd64c7b8c493413bd3cb1b3e910cbdaa46456a2b1762e259360933c5bd3","observation_id":"5400dcea-a7cc-47d0-9f75-0106a6a32dfc","resolution":{"observed_at":"2026-08-07T05:11:01.187535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.173652Z","title":"When is task vector provably effective for model editing? a generalization analysis of nonlinear transformers","venue":null,"work_id":"a3acdd20-2ad8-4f07-ad29-5e92a96f3d01","year":2025},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.494093Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:fe244bf6619898c046588475b3bc463f4a99d3e650ee0e03294b2bce3ca53752","observation_id":"86dee089-e500-437d-a904-a7b6037acbd9","resolution":{"observed_at":"2026-08-07T05:11:01.177735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.162591Z","title":"Clip-event: Connecting text and images with event structures","venue":null,"work_id":"33eb5041-f702-4776-906c-cd5a64ad640d","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.497348Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:fd5d5c9797d14ae30dd0528a18ebda7c4ce20104b70003dcf7ffbc26852a9d9b","observation_id":"49cfc696-8999-48c7-aeb8-82b659d29b44","resolution":{"observed_at":"2026-08-07T05:11:01.166476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.151397Z","title":"Local to global: Learning dynamics and effect of initialization for transformers","venue":null,"work_id":"d5abc46f-80e9-40ec-b7fe-85b9ef3f2e63","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.500686Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:ce7acfd7d757664560275e85df688096505422d71b15ed766a66f2031a14496a","observation_id":"a508da4a-b8e9-4e30-947f-bdba63f62306","resolution":{"observed_at":"2026-08-07T05:11:01.155304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.140571Z","title":"Matena and Colin A","venue":null,"work_id":"040a99dd-cbe8-4b96-ad77-3188144809f9","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.504140Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:928e1451f7d11f564ae0ecf67079187537cd1a7cea51f22aa911688964c3ba7f","observation_id":"29c4f50f-00de-4a79-94f3-2b1162ed81da","resolution":{"observed_at":"2026-08-07T05:11:01.144058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.129904Z","title":"Reading digits in natural images with unsupervised feature learning","venue":null,"work_id":"a4092f8c-dca8-494f-bbb1-0f47c46c8508","year":2011},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.507322Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:79bbbaa1c92ffe95b1a4097fd8553a8fd7a23ad9d153bb7fa21e7cd6e6a7d047","observation_id":"322af6d9-1fc5-4c01-9c2c-0d396fad4408","resolution":{"observed_at":"2026-08-07T05:11:01.133830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.118151Z","title":"Saft: Towards out-of-distribution generalization in fine-tuning","venue":null,"work_id":"109e75ea-6f7c-4ad9-9681-9e496eee608a","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.510890Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:81af05bb482001f359ed71c3fec7d39dc943a65cbe2a20aff0df572b7b4ec932","observation_id":"f1d24631-6efc-4421-b8fd-cecd8814df77","resolution":{"observed_at":"2026-08-07T05:11:01.122195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.107265Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"30feca74-5293-4c67-8a09-3701d0c1d288","year":2008},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.514106Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:776d67f257203e5a830838cd75d3ab7988940837811d8a8834e21df2de0efc1c","observation_id":"d6e7a108-deff-4c12-ae5a-bddb8fbd7508","resolution":{"observed_at":"2026-08-07T05:11:01.110914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.096362Z","title":"Cats and dogs","venue":null,"work_id":"f7b430bf-f573-4d98-bbfd-e9549c1737c8","year":2012},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.517975Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:3568e0e719d53c95bdffd01a139e88ae7386b61f68d530d832807178e82368b4","observation_id":"9e8a6562-f9e7-4eff-9bed-8fc170e87db5","resolution":{"observed_at":"2026-08-07T05:11:01.100505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.085021Z","title":"What to pre-train on? efficient intermediate task selection","venue":null,"work_id":"1b4949ec-bbe7-46f0-9570-a302fac378f6","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.521074Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:6a7d5213d81fa9932834d372d6673913863dd04f6309129bb6bef61c8cfc86a6","observation_id":"ccedc1a4-3c26-4978-b2c1-7d4c22ff6dd9","resolution":{"observed_at":"2026-08-07T05:11:01.089093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.073814Z","title":"What to pre-train on? efficient intermediate task selection.Empirical Methods in Natural Language Processing,Empirical Methods in Natural Language Processing, 2021","venue":null,"work_id":"51da63f3-bb66-4352-abbf-c2ecc56a643d","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.524357Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:867886bc4a68318526369a2cf04c7a203c58a72945bc612191fbc69c07c32ffd","observation_id":"f0bd8d7a-8507-4369-a58f-889f36a0bbc0","resolution":{"observed_at":"2026-08-07T05:11:01.077852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.063263Z","title":null,"venue":null,"work_id":"f5893320-a1a1-4d2e-b741-23396365b12d","year":2020},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.527738Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:c1bdf4cf0b5d8776bd764d8f1c9b1cd365cf089cfac23c1bd9aa446bb9ea66d0","observation_id":"89783abb-78bc-40dc-a4b4-729da2aa8432","resolution":{"observed_at":"2026-08-07T05:11:01.066892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.531060Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8):9, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.531060Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:b7949e38f9b72f6d4cb668f5b9d3e3c95ddb42bedb398726fc0da17ff66888ad","observation_id":"0996512b-401d-4d00-94c6-8befa21d4f80","resolution":{"observed_at":"2026-08-07T05:11:00.531060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.044656Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"0a8f00cf-71aa-491a-a7bf-53e84ee9fa6b","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.534316Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:778724cdbcbbf6c783d72af74c0b362cae0e263b050d405a7bf12a2ba1cc5052","observation_id":"7a39b49c-a86a-433f-9d07-44fb2e89fcce","resolution":{"observed_at":"2026-08-07T05:11:01.048714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.032339Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"5784b856-4ce8-429a-a00e-ebcb9852d7ce","year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.538141Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:86ddc1c62ddb02b06f360df629443f4ed78a5959805729dda7dc568c9add4f01","observation_id":"e5818e7a-0693-4372-857d-b1d63ce5b79d","resolution":{"observed_at":"2026-08-07T05:11:01.036434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.020415Z","title":"On the effect of dropping layers of pre-trained transformer models.Computer Speech and Language, 77, 2023","venue":null,"work_id":"4d251a05-0ff7-47c1-ada3-92db4ba267ca","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.541481Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:dc5fbd86a5c7ea0a32677f6b24a69ac0cb2230bd1c4e5c73947406a973e592a0","observation_id":"4311f273-a2ae-495a-ae3b-60f785ad7636","resolution":{"observed_at":"2026-08-07T05:11:01.024215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:01.008630Z","title":"Movement pruning: Adaptive sparsity by fine-tuning","venue":null,"work_id":"7093c680-299e-4b77-b5f0-235f6eed0dd9","year":2020},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.545049Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:32d03da9b817ef800a1d0521ce36dc56a9c762bbd6fd04e667638406a94189a8","observation_id":"6177e412-4ee4-4700-9d4e-b76fdf831966","resolution":{"observed_at":"2026-08-07T05:11:01.013546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.997955Z","title":"Multitask prompted training enables zero-shot task generalization","venue":null,"work_id":"d95cc83a-36b5-400f-83e8-c7534cea3897","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.548270Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:f08c7226835603a948bbcc0e473cc0b7d0a78f7711cba2d509affe7f0b31ad3e","observation_id":"e59b2caa-576b-41a3-af52-52473bb13666","resolution":{"observed_at":"2026-08-07T05:11:01.001924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.986755Z","title":"Label sleuth: From unlabeled text to a classifier in a few hours","venue":null,"work_id":"4d5768ef-ec48-44ed-840b-dd2b2fe8babf","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.551730Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:bef0dc866221f8e7ae0b66e88be38ae8e1c4c50d1cd4afe776e0032140d79f9d","observation_id":"1d2973e4-6ab9-44a7-9fba-0d2ebf6ad2cb","resolution":{"observed_at":"2026-08-07T05:11:00.990786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.975155Z","title":"Lora vs full fine-tuning: An illusion of equivalence.arXiv e-prints, pages arXiv–2410, 2024","venue":null,"work_id":"5bb7d5ec-913c-4626-a523-c0422071d9e1","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.555118Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:e83be13c7f7da89e5144bba950d6925d00c64e50c8be3ea56fdd41a7a76c4b08","observation_id":"d4dfe531-1aff-482e-84df-f73d92e8c235","resolution":{"observed_at":"2026-08-07T05:11:00.979030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.963420Z","title":"Model fusion via optimal transport","venue":null,"work_id":"c9c40a7a-8a45-410e-a582-b258342b1ad6","year":2020},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.558257Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:3ed11494990ae0567bebcc8176a52ad6f74334c73fd48e6ba2fbed06c283e4c6","observation_id":"f820d193-a467-4150-9f5d-93d2ffb23088","resolution":{"observed_at":"2026-08-07T05:11:00.967470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.951176Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":"e8315829-0818-4692-82a7-b8ee9acad5a0","year":2013},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.562409Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:1e24e68dfd13b62ef7a6b0829bd76c999f634faf277696011091e0acca0640a2","observation_id":"ed41a11c-cf37-4013-abeb-80b8748e3928","resolution":{"observed_at":"2026-08-07T05:11:00.955852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.939191Z","title":"The german traffic sign recognition benchmark: a multi-class classification competition","venue":null,"work_id":"7c120d44-bcf0-4f1e-8bb8-5b571999825f","year":2011},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.565934Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:6715c2eb0311f83b726d3b52ba2cf00024f971540845bed730279829a5117b51","observation_id":"8dce760f-97e9-4d18-b21e-11c370eab57f","resolution":{"observed_at":"2026-08-07T05:11:00.943362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.927583Z","title":"Rotation equivariant cnns for digital pathology","venue":null,"work_id":"67cd8c73-06f2-4878-9763-cbf7c7f2c9ed","year":2018},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.569435Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:274aae586453cabd58783783a9188c41d7f50815c8add16e7a5d9d3f1e73f4b7","observation_id":"5a0aca2b-feeb-45cf-bbb4-e61ba23af6a2","resolution":{"observed_at":"2026-08-07T05:11:00.931234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.573098Z","title":"Multi-task learning for dense prediction tasks: A survey.IEEE transactions on pattern analysis and machine intelligence, 44(7):3614–3633, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.573098Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:c5ab74313f5ef18a76b44ce13ef8d69bb613ba1368ac5e64970e39786d4c44d6","observation_id":"511a6422-487a-4117-adb6-7583f89891a9","resolution":{"observed_at":"2026-08-07T05:11:00.573098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17146","last_updated":"2025-02-28T10:53:12Z","snapshot_observed_at":"2026-08-02T18:59:33.544719Z","submitted_at":"2024-10-22T16:26:05Z","title":"LiNeS: Post-training Layer Scaling Prevents Forgetting and Enhances Model Merging","version":2},"cited_work":{"arxiv_id":"2410.17146","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.17146","snapshot_observed_at":"2026-08-07T05:11:00.746855Z","title":"LiNeS: Post-training Layer Scaling Prevents Forgetting and Enhances Model Merging","venue":"cs.LG","work_id":"56e3e665-3530-4167-82a3-a62c9cbfebf1","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.576585Z"},"links":{"cited_paper":"/paper/2410.17146","citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:88f334cf8f1c0dc9e108c11db99746d0a3ceffc039e4fc1f69fdc2b1b247ac5d","observation_id":"50a0dcb5-2fa4-40fc-b0cc-184e6f0ecc94","resolution":{"observed_at":"2026-08-07T05:11:00.751897Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.909772Z","title":"Localizing task information for improved model merging and compression","venue":null,"work_id":"0ea26a71-e60a-49a6-9c16-5fed93ef191b","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.580597Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:c9637b0c2dfdde12c5c8160455b98293b1bd1043195f40b52c9d2a931e2589d0","observation_id":"fcc6a927-7bb3-451c-9789-a175cfc8c95f","resolution":{"observed_at":"2026-08-07T05:11:00.914294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.898886Z","title":"When to use multi-task learning vs intermediate fine-tuning for pre-trained encoder transfer learning","venue":null,"work_id":"34a48d41-97bb-4572-8543-5804786de273","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.583921Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:6433cd3a8a345d0a29842c63202a284a2a52667f18b6fa1e621a2fedff0c66ff","observation_id":"c8267882-2436-408b-a24e-f9ca2207c3a1","resolution":{"observed_at":"2026-08-07T05:11:00.902598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.887855Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time","venue":null,"work_id":"efcff0b2-e8ae-498d-b597-fc045c83f40b","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.587963Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:6740a92ac8e2d7734c9ba97ea7021eedb0546e900cd9f8ed0e78da74c444c7d7","observation_id":"a30479ff-731b-43bc-87a0-f9a4288b7c13","resolution":{"observed_at":"2026-08-07T05:11:00.891838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.876202Z","title":"Robust fine-tuning of zero-shot models","venue":null,"work_id":"798f08f8-35b0-430b-b53b-217c21a57bd0","year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.591381Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:da013c85798f0ea6926aa5ed2e172693531973bad92b3b91d2485f2a574f2bef","observation_id":"19d637e0-7711-4582-9cb5-6fd7eff0cd02","resolution":{"observed_at":"2026-08-07T05:11:00.880242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.07747","last_updated":"2017-09-15T21:29:49Z","snapshot_observed_at":"2026-07-06T05:56:41.814255Z","submitted_at":"2017-08-25T14:01:29Z","title":"Fashion-MNIST: a Novel Image Dataset for Benchmarking Machine Learning Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.07747","snapshot_observed_at":"2026-08-07T05:11:00.595344Z","title":"Fashion-mnist: a novel image dataset for benchmarking machine learning algorithms.arXiv preprint arXiv:1708.07747, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.595344Z"},"links":{"cited_paper":"/paper/1708.07747","citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:65d8e5147ebdc6214a59779b0de3e62f7ab161c5b79d3e61008fdb2c3b608663","observation_id":"7be74f7e-931a-4456-a4e3-c29203040758","resolution":{"observed_at":"2026-08-07T05:11:00.595344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.864068Z","title":"Sun database: Exploring a large collection of scene categories.International Journal of Computer Vision, 119: 3–22, 2016","venue":null,"work_id":"ee1b70ec-74f9-482d-a2eb-312c1c0afdc1","year":2016},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.599827Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:3a0a9ab1a3d7e82296db8b5e13c371d02584e2aab3a62ee54757dddef954e527","observation_id":"0efccd2e-462b-4345-9d4c-25e1edc3f007","resolution":{"observed_at":"2026-08-07T05:11:00.868098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.851652Z","title":"Resolving interference when merging models","venue":null,"work_id":"2952abd4-1f7a-425b-8d40-55e762ceb998","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.603047Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:0e252fa18f0805b1d319f58d45181e6755c86ceaa49a93cca6303f8bd6b5dafe","observation_id":"c92d3e4f-b253-4820-be98-e7c125f01181","resolution":{"observed_at":"2026-08-07T05:11:00.856279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.841405Z","title":"Representation surgery for multi-task model merging","venue":null,"work_id":"1acda03f-0bbe-4227-8ceb-8968f4403ab5","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.606420Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:c192416213b3e92441de61cb681bda48f8c0d358f3faa1fbd45298468e680ff8","observation_id":"7e10759d-e645-412d-8895-f70c349a82a7","resolution":{"observed_at":"2026-08-07T05:11:00.844903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.830430Z","title":"Adamerging: Adaptive model merging for multi-task learning","venue":null,"work_id":"e09c1d64-002e-45bf-9ea6-800efc0a5738","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.609756Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:0a793ae872b7cbd37434720b52eb6cf5fef4e333338e3d582028dd5fb8068623","observation_id":"92be1cb1-3d66-4a51-9853-94642e2cf7e8","resolution":{"observed_at":"2026-08-07T05:11:00.834284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.819698Z","title":"Language models are super mario: Absorbing abilities from homologous models as a free lunch","venue":null,"work_id":"3e1420aa-65ce-4bce-9657-9150d90219c1","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.613226Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:413217e1d209d80c7b4410d6f5517d60e46142ec886e022609c07a98405743db","observation_id":"329db82c-a6d0-422e-984d-db723530eaf4","resolution":{"observed_at":"2026-08-07T05:11:00.823784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.808973Z","title":"Uni3d: A unified baseline for multi-dataset 3d object detection","venue":null,"work_id":"bc69f2e4-56ef-4635-ab8f-f8f1b2dd1e8b","year":2023},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.616777Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:f90d2fed9f138eb9f4a183768f26e58d08a681e2f041913f6a576d4f6ed214e1","observation_id":"660e37ae-ebf6-4b31-bec9-a38d18770236","resolution":{"observed_at":"2026-08-07T05:11:00.813090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.620114Z","title":"Learning to prompt for vision-language models.International Journal of Computer Vision, 130(9):2337–2348, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.620114Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:dad8ded210d6b17d5a70717b6d94a2e54dc703664cf9a9949fa2d3dab7bea262","observation_id":"301e045c-339c-499a-a891-fd9a27499f18","resolution":{"observed_at":"2026-08-07T05:11:00.620114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.791252Z","title":"Model tailor: Mitigating catastrophic forgetting in multi-modal large language models","venue":null,"work_id":"18e4cc63-3da3-43b8-938e-9b9d855187d3","year":2024},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.623716Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:b0cdbd0abf613ac9cecdb85877925b11d47f01ea5a6ef1bcb18a8bb010b4c704","observation_id":"a4f53cf2-2d2d-498f-a823-6e8a7d15710c","resolution":{"observed_at":"2026-08-07T05:11:00.794881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1400.00000","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.716435Z","title":"Limitations","venue":null,"work_id":"732c6a1c-685f-4461-9fa7-00617df6550e","year":2020},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.627433Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:19d148636552a60a4ec8643145c520dbaecb0112932e8fc3a59ecdf2b424969d","observation_id":"95618173-64fc-4a32-84a5-860b2af7e430","resolution":{"observed_at":"2026-08-07T05:11:00.723683Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:11:00.780736Z","title":"• Depending on the country in which research is conducted, IRB approval (or equivalent) may be required for any human subjects research","venue":null,"work_id":"42b127c4-f863-4a7a-b78a-16f7e26cd4e0","year":2025},"citing_paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T05:11:00.632589Z"},"links":{"citing_paper":"/paper/2506.09093"},"observation_digest":"sha256:043e9b0ddb1f7bb647b607638d06cbf12ca472ad2383bf1e5121b0918306ddc3","observation_id":"5a5c5995-65dd-430d-bd5d-721b3d7261eb","resolution":{"observed_at":"2026-08-07T05:11:00.784391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09093","last_updated":"2025-06-13T09:02:50Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T05:01:38.768525Z","submitted_at":"2025-06-10T11:34:23Z","title":"Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":61},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 2 inbound Pith citation observations for arXiv:2506.09093."}