{"as_of":"2026-08-10T20:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:074e913fe4f916c734f57634ff6857186817a9e03262efd08f958fe770fd10bc","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:05:31.290393Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.07577/citation-record","integrity":"/paper/2508.07577/integrity","json":"/paper/2508.07577/citation-record.json","paper":"/paper/2508.07577"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.882274Z","title":"Bach: Grand challenge on breast cancer histology images","venue":null,"work_id":"acf0ec62-740a-4bb9-b495-f5f04e89db38","year":2019},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.122391Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:27e04f7b8527d75a67efcd534813b54a64dc32fa6ec15d27d8287211d1cd9399","observation_id":"4c74dd93-e130-4ebe-b0ca-78c1bdc7a65e","resolution":{"observed_at":"2026-08-05T22:05:31.887113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-05T22:05:31.128000Z","title":"Layer normalization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.128000Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:f0c42914794193139cccdd7ed4e1ebb695f722febd3fd5552579d4a5b68bfe77","observation_id":"7616a902-e169-482f-ae9a-d23304f7476c","resolution":{"observed_at":"2026-08-05T22:05:31.128000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.869163Z","title":"o l \\\"o nen, Satu Mustjoki, and Oscar Br \\","venue":null,"work_id":"f9f41ad8-20ac-469d-9925-683a77f6f650","year":2023},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.132212Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:bf6fd9933a325e503fe36cdf344379064d957c2f40594472103a698899e82057","observation_id":"15b8d6e9-dd26-4372-8d86-b14c3ffa1a90","resolution":{"observed_at":"2026-08-05T22:05:31.873858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16385","last_updated":"2024-04-25T07:51:26Z","snapshot_observed_at":"2026-07-06T18:05:20.955471Z","submitted_at":"2024-04-25T07:51:26Z","title":"Efficiency in Focus: LayerNorm as a Catalyst for Fine-tuning Medical Visual Language Pre-trained Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16385","snapshot_observed_at":"2026-08-05T22:05:31.136572Z","title":"Efficiency in focus: Layernorm as a catalyst for fine-tuning medical visual language pre-trained models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.136572Z"},"links":{"cited_paper":"/paper/2404.16385","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:798adfc5a974870d8c780a3b0ce234a51d537403df20ac9113e7318c847fc383","observation_id":"e4c5f54b-065b-4e55-90b1-ae750dadce33","resolution":{"observed_at":"2026-08-05T22:05:31.136572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.857101Z","title":"Describing textures in the wild","venue":null,"work_id":"02a440e3-9194-473b-9fad-d5054584940a","year":2014},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.141511Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:b3ffcb2296d93a879123510e24469db2ff3414098e8ad6e46144f0eb8838a7f5","observation_id":"69493c59-1b2d-4ec7-9187-5cdd4492a7ba","resolution":{"observed_at":"2026-08-05T22:05:31.860721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.843955Z","title":"On the effectiveness of layernorm tuning for continual learning in vision transformers","venue":null,"work_id":"03ddea96-3b36-42ad-a6a7-84c6614e3bd6","year":2023},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.145357Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:327071e4345da9f4005546e74d78cee6c83a3a1ecc1e2900d3a5cebe69c8bc74","observation_id":"63d40631-1fae-44ea-bed9-022f1b4dd95f","resolution":{"observed_at":"2026-08-05T22:05:31.848025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19666","last_updated":"2024-11-29T12:39:57Z","snapshot_observed_at":"2026-08-02T16:14:35.442247Z","submitted_at":"2024-11-29T12:39:57Z","title":"Multimodal Whole Slide Foundation Model for Pathology","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19666","snapshot_observed_at":"2026-08-05T22:05:31.149976Z","title":"Multimodal whole slide foundation model for pathology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.149976Z"},"links":{"cited_paper":"/paper/2411.19666","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:855f7eec30acae37c7405a2df6d1e44b04a3de4761dbf15077f8165440114795","observation_id":"5d32f711-a32a-4423-bcce-0ba9e64fb91a","resolution":{"observed_at":"2026-08-05T22:05:31.149976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T22:05:31.153968Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.153968Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:3bf26bf2e9f53aaa4a935c78daa7cbf7935af21b91f7d81546d81e82e2488843","observation_id":"5a8b87b3-2ff3-4566-ab95-77a51305e432","resolution":{"observed_at":"2026-08-05T22:05:31.153968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07937","last_updated":"2023-07-04T21:33:17Z","snapshot_observed_at":"2026-08-09T17:52:57.311558Z","submitted_at":"2023-02-15T20:44:31Z","title":"The Expressive Power of Tuning Only the Normalization Layers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07937","snapshot_observed_at":"2026-08-05T22:05:31.158369Z","title":"The expressive power of tuning only the normalization layers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.158369Z"},"links":{"cited_paper":"/paper/2302.07937","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:b58ba742ece046d1ac553bdec00fce6811fc4ed7f7f1bf8398b9550831b298a5","observation_id":"9827b0a1-f2b3-42db-9e3d-f05150c08d35","resolution":{"observed_at":"2026-08-05T22:05:31.158369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.831552Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"a3bbea08-6dd5-4c9c-9798-1c167b15a437","year":2022},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.162487Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:6b2f7679f5e7c1700afa7214b7350dd833d69195945ba2b671d071aacecd0b39","observation_id":"fe016dda-342f-4070-9e42-c6540be33f65","resolution":{"observed_at":"2026-08-05T22:05:31.835445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.818891Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":"45ddfae5-4156-408e-ad70-37ef23c12315","year":2019},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.166122Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:79af45a1bc2a111f0d609bfc323da0892adcb8e34a86b485b05b42a494da5fa9","observation_id":"6c16f01d-bdc3-4a66-8034-a9be1fe347ac","resolution":{"observed_at":"2026-08-05T22:05:31.823179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.805529Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"f58cf447-e10c-49ac-a978-7b4ca558833e","year":2022},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.170076Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:4be6799074a8d40b8f6eb798ec550935f416e5206587d5d3a202c4797ddd6152","observation_id":"33de2fcf-ef51-4860-8069-ef56b08d9d03","resolution":{"observed_at":"2026-08-05T22:05:31.810130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.792611Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","venue":null,"work_id":"b68f6521-0a4e-4a4e-a82f-b3ba4e1ef3f1","year":2015},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.173816Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:03b376b9c2b714dfd76c6ef4ae805f3c7b473d86f868631948a55967b5d1468e","observation_id":"aec3d6c7-b3f9-40d3-9b66-403e109760dc","resolution":{"observed_at":"2026-08-05T22:05:31.796675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.778776Z","title":"Visual prompt tuning","venue":null,"work_id":"546496cc-f812-4f03-8342-82e6a95ee518","year":2022},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.177415Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:29b02cdf8ef6aa827c28c0e030666c89256d495fc346d1bd63d7f4d00a4894b1","observation_id":"1375129a-18d1-434f-a447-65b610887029","resolution":{"observed_at":"2026-08-05T22:05:31.783169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.765419Z","title":"Fact: Factor-tuning for lightweight adaptation on vision transformer","venue":null,"work_id":"02adc6b3-4226-4edb-abdf-8e0c5219949f","year":2023},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.180992Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:64d28400a80a0a93f28d0953c3ae5c6f994d10c86c3517b15aea6696ab3f679a","observation_id":"4b0dfa3b-93a7-476e-8bdd-404793ac5e9f","resolution":{"observed_at":"2026-08-05T22:05:31.769361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10054","last_updated":"2022-02-21T09:03:34Z","snapshot_observed_at":"2026-08-09T11:23:03.445810Z","submitted_at":"2022-02-21T09:03:34Z","title":"Fine-Tuning can Distort Pretrained Features and Underperform Out-of-Distribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10054","snapshot_observed_at":"2026-08-05T22:05:31.184727Z","title":"Fine-tuning can distort pretrained features and underperform out-of-distribution","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.184727Z"},"links":{"cited_paper":"/paper/2202.10054","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:f8ba5402dd0bc879121ff540b338e05728fd246e155a3bd25f71004939d75510","observation_id":"605a62a3-209e-433a-b524-86864bf21fe3","resolution":{"observed_at":"2026-08-05T22:05:31.184727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.752749Z","title":"A visual-language foundation model for computational pathology","venue":null,"work_id":"0f32a8e3-b465-4eab-8f8d-d338b036fab8","year":2024},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.188616Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:3b16e6254831cf4eb55cb3fe8297e679cbb4d0cca36c36c4ba62d8c93d8e0d5a","observation_id":"fb4191d4-ca7b-47dc-9c62-5eeeac0d98ea","resolution":{"observed_at":"2026-08-05T22:05:31.756594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.740221Z","title":null,"venue":null,"work_id":"ffb40b04-cba7-45ae-8e6b-b4c4e816b9cb","year":2023},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.192675Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:74728d4eab56f5fbeeb4eababf3c85588a788d30a4fe543fe86d938ed7116d15","observation_id":"274fe8c1-49e8-463c-bbe5-9ca0fdb0aa3f","resolution":{"observed_at":"2026-08-05T22:05:31.743995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.727445Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"9088a1f9-5867-4eea-83d1-324cb7d6bc59","year":2023},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.196237Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:57d81fcb96fc0f2be441acf636f86fec6a0069295627ef4561011b83e36476cc","observation_id":"dad2e229-01c5-45c6-9023-039e5ad26404","resolution":{"observed_at":"2026-08-05T22:05:31.731366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.714252Z","title":"Moment matching for multi-source domain adaptation","venue":null,"work_id":"aa4edb79-f04c-40e4-8a04-10ebafc81821","year":2019},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.199866Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:90e2eae4621a3aa35982bf2d6d3cde8dbcd8d5f6f27f6bce309b44469541f893","observation_id":"b0b3b486-1f09-4fa2-8166-bad2891acb88","resolution":{"observed_at":"2026-08-05T22:05:31.718245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.08682","last_updated":"2022-12-09T14:53:21Z","snapshot_observed_at":"2026-07-06T14:19:11.158464Z","submitted_at":"2022-11-16T05:31:49Z","title":"Parameter-Efficient Tuning on Layer Normalization for Pre-trained Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.08682","snapshot_observed_at":"2026-08-05T22:05:31.203945Z","title":"Parameter-efficient tuning on layer normalization for pre-trained language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.203945Z"},"links":{"cited_paper":"/paper/2211.08682","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:bd335815d319346b7c177fe608488ed3b5fa6d057120e63f7739622cca672897","observation_id":"43b117eb-dd29-46f6-a6b6-5475cf2dbe5b","resolution":{"observed_at":"2026-08-05T22:05:31.203945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.208301Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.208301Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:02b4c555afd0319ce17037eead93b1e8392e6b7f35ad58e4c15bd0531af61635","observation_id":"e952d51c-bb49-40af-aefa-abfe5dbbd581","resolution":{"observed_at":"2026-08-05T22:05:31.208301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.692096Z","title":"Parameter-efficient multi-task and transfer learning, June 13 2023","venue":null,"work_id":"9c9fb5c5-fcda-442b-bb4a-005bd44d9114","year":2023},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.211919Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:43fbb6f6a4e4a4df02d736cb100683ee5ace4cc41c5125a36fafe795e75d95d5","observation_id":"52f69b16-5f31-4406-95e6-2654b1937f22","resolution":{"observed_at":"2026-08-05T22:05:31.696026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.678207Z","title":"Gland segmentation in colon histology images: The glas challenge contest","venue":null,"work_id":"701e9c1a-345a-453b-9127-e2d694153610","year":2017},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.215515Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:6439f7f8fd763a3e3b14e82cb31a09835a47f879e3534e56efb6752546183709","observation_id":"b5f0f03c-af8b-4907-a87d-24aacc1860e8","resolution":{"observed_at":"2026-08-05T22:05:31.682957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.664415Z","title":"A dataset for breast cancer histopathological image classification","venue":null,"work_id":"84aacd94-c828-43b9-9d23-472cd630485b","year":2015},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.221723Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:105296991df8f4eb4957796aacb25d0b05d7d625ad93fe2c48b89798cefc41bf","observation_id":"fbbdaa63-9513-44e2-8442-dd4f300f9e77","resolution":{"observed_at":"2026-08-05T22:05:31.668448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.08022","last_updated":"2017-11-06T14:21:43Z","snapshot_observed_at":"2026-08-05T08:35:49.218794Z","submitted_at":"2016-07-27T10:23:00Z","title":"Instance Normalization: The Missing Ingredient for Fast Stylization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.08022","snapshot_observed_at":"2026-08-05T22:05:31.239572Z","title":"Instance normalization: The missing ingredient for fast stylization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.239572Z"},"links":{"cited_paper":"/paper/1607.08022","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:3ffc4623284bf8ad83891d6181b6b4bb80f4bba100672b06fa3c3e4b095295a0","observation_id":"38f0c0ac-22cd-42d8-82f5-3b292bdfd5d4","resolution":{"observed_at":"2026-08-05T22:05:31.239572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20284","last_updated":"2024-03-29T16:53:11Z","snapshot_observed_at":"2026-07-06T17:53:11.000124Z","submitted_at":"2024-03-29T16:53:11Z","title":"LayerNorm: A key component in parameter-efficient fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20284","snapshot_observed_at":"2026-08-05T22:05:31.257892Z","title":"Layernorm: A key component in parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.257892Z"},"links":{"cited_paper":"/paper/2403.20284","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:f8da0d46f7b6685ef53bada2306dbc879f4cc7b5efa3296c1ce47fb562d46475","observation_id":"a54b057a-98b8-406f-86e2-d94f508c6a6e","resolution":{"observed_at":"2026-08-05T22:05:31.257892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.651105Z","title":"A pathology foundation model for cancer diagnosis and prognosis prediction","venue":null,"work_id":"7775468a-a405-45ad-83e8-6ecb5272df38","year":2024},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.265861Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:35066564eb27e85fd2cb563915f9ae2073db23a10439dc8a08578a9900b9ec1d","observation_id":"7cd4b978-5161-4386-ac14-d02c9da4c8a4","resolution":{"observed_at":"2026-08-05T22:05:31.655272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.638004Z","title":"Group normalization","venue":null,"work_id":"69ccb8a3-6867-4c3a-ac33-33152b85ff1d","year":2018},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.269952Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:2d9bec88f625e02db4ae82eec8d9956ebd9226434d3bef008cf108865a0e6ed0","observation_id":"cb39e61c-2090-4100-b6d6-53f82c1ff25b","resolution":{"observed_at":"2026-08-05T22:05:31.641864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.625081Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"ac5800ae-682a-4d47-89d4-a5399f9c6e4f","year":2010},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.273508Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:24e73811f011c1edc39b7a89623de1fae3dff306df1ddb39af0546990f7ab3fa","observation_id":"1b9ed040-d721-423e-9a54-49bdde28b415","resolution":{"observed_at":"2026-08-05T22:05:31.629472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.609972Z","title":"Understanding and improving layer normalization","venue":null,"work_id":"0d6dbc42-c011-4c22-8eaa-0a77ce4a681d","year":2019},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.277655Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:d0fbbb0493f897fecd112e434c4a06dca5ca6fe41f95ffb669a9b3435d9fb4f7","observation_id":"fdf39c2a-7418-44c7-9bea-fd17158fe6e1","resolution":{"observed_at":"2026-08-05T22:05:31.615737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:05:31.281257Z","title":"Bitfit: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.281257Z"},"links":{"citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:ea09d3c59b7295f5547b662b4b8e4ab8112451e794cec9d745c5c689f43252ee","observation_id":"18a79a0f-428f-41ca-a542-6156ee9f0aaf","resolution":{"observed_at":"2026-08-05T22:05:31.281257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11420","last_updated":"2023-12-18T18:21:43Z","snapshot_observed_at":"2026-07-06T17:04:46.288600Z","submitted_at":"2023-12-18T18:21:43Z","title":"Tuning LayerNorm in Attention: Towards Efficient Multi-Modal LLM Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11420","snapshot_observed_at":"2026-08-05T22:05:31.286262Z","title":"Tuning layernorm in attention: Towards efficient multi-modal llm finetuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.286262Z"},"links":{"cited_paper":"/paper/2312.11420","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:8da0dcf40d4b454e3305ad17bfe614cf4047c13e0490296ee1334b54ff470eb0","observation_id":"ae76d5cd-8e71-437a-abfa-5da13c3106dc","resolution":{"observed_at":"2026-08-05T22:05:31.286262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10622","last_updated":"2025-06-14T08:10:48Z","snapshot_observed_at":"2026-08-07T22:20:27.338782Z","submitted_at":"2025-03-13T17:59:06Z","title":"Transformers without Normalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10622","snapshot_observed_at":"2026-08-05T22:05:31.290393Z","title":"Transformers without normalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T22:05:31.290393Z"},"links":{"cited_paper":"/paper/2503.10622","citing_paper":"/paper/2508.07577"},"observation_digest":"sha256:2f3d81c31e8f33667e4743f6ef2a0d70f01b2c6a82535c5ac8f8645aef1049be","observation_id":"acfd7169-d380-4f86-9d17-639b344d410c","resolution":{"observed_at":"2026-08-05T22:05:31.290393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.07577","last_updated":"2025-08-11T03:18:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:22:09.804957Z","submitted_at":"2025-08-11T03:18:47Z","title":"Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2508.07577."}