{"as_of":"2026-08-11T14:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83a0b314ad63aa12280bd51b6a52c4886504eedd9984e09fe06da2c58e00df67","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T01:27:24.402364Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T06:14:15.743809Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.26379","snapshot_observed_at":"2026-08-01T06:14:15.743809Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21973","last_updated":"2026-07-24T04:39:55Z","snapshot_observed_at":"2026-08-06T07:42:08.594130Z","submitted_at":"2026-07-24T04:39:55Z","title":"Rethinking Layer-Wise Information Allocation for Vision Foundation Model Adaptation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T06:14:15.743809Z"},"links":{"cited_paper":"/paper/2606.26379","citing_paper":"/paper/2607.21973"},"observation_digest":"sha256:92a82bc0b02805b3ae0703f12c22a1ea7ff72ebb95daba90b0c911eeb1fa262e","observation_id":"a2eae8d5-cd3a-4ac6-9c44-480d83a9ee36","resolution":{"observed_at":"2026-08-01T06:14:15.743809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.26379/citation-record","integrity":"/paper/2606.26379/integrity","json":"/paper/2606.26379/citation-record.json","paper":"/paper/2606.26379"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:ecefbaa999124cbb090ad14a9c7886ee548f55b03490a1e54b3d7c1157190a1e","observation_id":"02eec673-95ec-4848-9ed7-c723164bb21d","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:37a550260953a5a63ed42e32ed4760863f66ccb6a73c7f3df6a6d146d8f355b3","observation_id":"8dc28dc4-4cf7-492a-816c-25ce460b6922","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Visual recognition with deep nearest centroids","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:cd2b2e656575a1edd4659f5c8fde3d6b4243248c8a38823f17c276a9860201fb","observation_id":"73111729-0e2c-4dbb-ac4d-a45ff0eefd15","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Visual prompt tuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:e7a33786196c5e47b4aa360ca52fe5abdd7c1c83622721e6a953e5927b9ea13d","observation_id":"2fe18a64-db0e-40d8-87e1-6b6fc029f3c8","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"All you need is one: Capsule prompt tuning with a single vector","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:319207449216430f96eee6686e00e98cade57b8c204a6c25d7f20612ee61afc5","observation_id":"6d743e87-a651-4302-8f89-aa7eb7d711e7","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14787","last_updated":"2026-04-25T07:16:50Z","snapshot_observed_at":"2026-08-02T09:27:54.026907Z","submitted_at":"2025-07-20T02:08:23Z","title":"FOCUS: Fused Observation of Channels for Unveiling Spectra","version":2},"cited_work":{"arxiv_id":"2507.14787","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.14787","snapshot_observed_at":"2026-07-04T15:49:56.328586Z","title":"FOCUS: Fused Observation of Channels for Unveiling Spectra","venue":"cs.CV","work_id":"e51daacc-b73f-4eaf-a8f3-5197e73bb716","year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"cited_paper":"/paper/2507.14787","citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:4b471bae41a0bec7052cc05109829fc39d7790e1bebfbe5f17f1e2b5abb9c5ec","observation_id":"545887ed-bb24-47fb-9f63-cdc18c5fcd78","resolution":{"observed_at":"2026-07-04T15:49:56.330396Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Self-supervised visual prompting for cross-domain road damage detection","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:9379f9548c0f057770766d9fa1c39734ade9c318c5f366c07d22925ea1b09ed1","observation_id":"6bad0f8e-656a-40e5-a9db-c176723d5a5e","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Do vision transformers see like convolutional neural networks? Advances in neural information processing systems, 34: 12116–12128, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:0beefe4dde473bf55cad26da0129a65158bcc7bc0c2e36e8455c4dabfe6ffb94","observation_id":"b6bc5f74-35c0-4826-a449-a65d5b1085e9","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Layer by layer: Uncovering hidden representations in language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:46563a235bf3c9d415b112dda6e8d91e116dcd8fbd431df2a77038c56eb0261b","observation_id":"8134ac21-3068-4134-bed2-68e15887de44","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Dispersion loss counteracts embedding condensation and improves generalization in small language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:764946dd155a0d868e3ccb033c21b9a416663087e436ec0e4f516baaa1229403","observation_id":"e15ecae1-463c-44c4-9eab-ffa786b945e2","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-07T10:46:08.274157Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":"physics/0004057","doi":"10.48550/arxiv.physics/0004057","metadata_source":"pith","pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The information bottleneck method","venue":"physics.data-an","work_id":"72655a80-0724-45ad-a330-1f4ed7aa613b","year":2000},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:5a00c650557026741c29c3e53afca862e1f445bb9d528ee9e6a3885b4a8e7074","observation_id":"c1afd4c7-0909-428a-a671-8a4e92ef764e","resolution":{"observed_at":"2026-07-04T15:49:56.350493Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-10T23:49:06.793856+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T23:49:06.793856+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04867","last_updated":"2020-02-21T13:36:15Z","snapshot_observed_at":"2026-08-09T06:48:42.729935Z","submitted_at":"2019-10-01T17:06:29Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","version":2},"cited_work":{"arxiv_id":"1910.04867","doi":"10.48550/arxiv.1910.04867","metadata_source":"pith","pith_arxiv_id":"1910.04867","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","venue":"cs.CV","work_id":"eb743d69-6704-47c1-bb0f-76520dd00c3d","year":2019},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"cited_paper":"/paper/1910.04867","citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:eb174e27fe2cfed16314052f58fbe629683db0dad0c35061cb282805c2aebe9b","observation_id":"82d98be5-df33-4f45-9684-4859b7140a99","resolution":{"observed_at":"2026-07-04T15:49:56.314788Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:c7441bafe3c42c81e8d5b58c6ad7236d27e8e1ee6990e6dc99d44e29adb7133d","observation_id":"7122de9b-bd04-42fd-ad26-878bc6c828cf","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Diversity-aware meta visual prompting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:b860e623966b2201cd7ec038d7ac8ecbe2b23295a7be8cab3a6a28866dbed875","observation_id":"e2ae869f-30e1-4e85-9486-eba5f696f3df","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Darts: Differentiable architecture search","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:2709982907dcc21df91aaf56a37e6c2c2037ea3219a036eb46a4410ede2aee21","observation_id":"e3893ed0-a159-46c2-a771-a7a965882077","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Convex optimization","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:527aa9660c85460186ec80b3b8077ad589c20ff1c0798dcc7d7ce218416c9b41","observation_id":"6dd5640b-013e-4be7-9d22-05ff7e2c775f","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Shannon entropy, renyi entropy, and information.Statistics and Inf","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:46e4036886e91fcd7bb181b002d905d23555e630fa84edd7aaece8a52038bf24","observation_id":"db12f776-a68e-4087-9995-43f3c20c5ed3","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:223f529d4acad38e7ccd007a74cacf147b99a0e157683d0aad88b67bd854a1be","observation_id":"a358a85f-135e-4317-9c23-71d2c99c6bd8","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Film: Visual reasoning with a general conditioning layer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:97704c9f9bce3e83afb2e715bdeb252d3225916f12d1e971bfad1370098b5e45","observation_id":"30b6c9d2-d434-497f-acbc-3d6263db4007","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:8382137d074bf6e11500d917faf331681759b1954c7d1fe71bb27202d11038d7","observation_id":"2533605a-e36d-474d-b04e-15fb7c6f3a90","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:e597f9a314bec23899ed77a63c0e8483c8d6c5b11ee8580e405b6836f96ca94e","observation_id":"0f975b65-1ab3-461f-9731-9fa4a64f71b6","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:10cd5e1558fffa4857f605f4de2507d63155f877427cbbe20e2bdae9197f121a","observation_id":"1924201a-0496-41d2-ad06-203169d58b17","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:45ee202e6a31c8203225118ee81eee1f120f7b4d128173833638473b0c5e6272","observation_id":"ec308675-5944-4b70-b569-f24f1c8c53d0","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"How well do sparse imagenet models transfer? In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pages 12266–12276, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:1a7e470b9054b151f9b839d59dae69c94d53200e0da823233898e3893936864e","observation_id":"96f33c4b-3d86-4fbf-a5b7-e849ba5cc8f6","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"How transferable are features in deep neural networks? Advances in neural information processing systems, 27, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:a782974ab7abe5c9c424f57369cd82d033a7bd8dc852e42c4974888aa51dd834","observation_id":"d4fd197b-e33c-404e-a982-80d949367e13","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":"2003.04297","doi":"10.48550/arxiv.2003.04297","metadata_source":"pith","pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improved Baselines with Momentum Contrastive Learning","venue":"cs.CV","work_id":"f275e715-bcdc-487c-bc31-6f98d8a01f5c","year":2020},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:4e502c34619fe8af91d4b42a7fe6eeea6e9ed9d5a175c7405c95b41e63733125","observation_id":"6b73fbb1-7e8e-42b4-b042-a9ebfa9a6ced","resolution":{"observed_at":"2026-07-04T15:49:56.342852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Side-tuning: a baseline for network adaptation via additive side networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:83b1051a52eb1bb31c4c04bde79229dcb414cb407e268c0f5eaf86f642b6ea10","observation_id":"22ac06bf-c721-477d-9c67-ba9bdef6c64f","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Learning multiple visual domains with residual adapters","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:a62b6dcf85d86fcbbc38bd4a552c884a457837ba3f882c25c403679e2c7fb7e8","observation_id":"d9ae52e4-3a1f-49ab-a16a-82df7ff1d17a","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Tinytl: Reduce memory, not parameters for efficient on-device learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:8081348b1a57d84d309547e9fcafc0f313f797abea99a0ad50f2b7edd073f448","observation_id":"dbf78982-33df-48ea-93f1-166ced51327d","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:24666dd1daa2cbd31b39a9c5e0c5b41ae103dbbced450191e8f329532ae3aa46","observation_id":"f56fbdb1-4aa8-49bd-a357-9357ac4ecbd4","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Adaptformer: Adapting vision transformers for scalable visual recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:9ee6b9dc80983a2ba00a13200fc15474638244b8892b319e2833dddc0fff2bd0","observation_id":"e19ded3a-e778-4e7b-b2d6-c72842cb8709","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Efficient adaptation of large vision transformer via adapter re-composing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:5f567234bfcaf5f46ed175ba22f8c8e75c8ba2975748d8d6a6b1895ec9c912f7","observation_id":"b8f42c0f-f310-4e6d-b4ff-47065196011a","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"E 2 vpt: An effective and efficient approach for visual prompt tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:6d43580579c659e0ad2d51363e7638b9f7bc668ed848168d925c173cea338dff","observation_id":"f0396b2a-2449-4ac6-b1d4-b73136b6a8dc","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Learning expressive prompting with residuals for vision transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:757139eb06d7013fa7f2a632956b82025ef44b4cac7820f9a666b03c17b356f1","observation_id":"5936f959-c278-444d-aab3-4daf25603e5a","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Sa 2vp: Spatially aligned- and-adapted visual prompt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:5f2b2f6cea7b9e2113684cd39ca7046d40b2196efcef5cca4aa2afe98e35b489","observation_id":"b085020d-1328-4290-b5dd-f1fb1347e2d4","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Revisiting the power of prompt for visual tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:725e8b910e42e4f550ea314749460befc54170944cb82f3ffd555fef98cbeeb5","observation_id":"514e512b-804c-485f-929f-3e1d9a8fc474","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Visual fourier prompt tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:fc854f425700d33ad51acb76ba7b9e851def34357c56289c2589325c9d26195a","observation_id":"1c616ac9-1af1-4e5c-b274-c1f5e5acbc45","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Lor-vp: Low-rank visual prompting for efficient vision model adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:40f65954f9c240615f7313c02b0abeabb29724de12f74d264b4ef36f1f4d213a","observation_id":"fdd790f8-86f4-4e74-88be-6340c4c4b13c","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Da-vpt: Semantic-guided visual prompt tuning for vision transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:ce329c86c98d7e2502e4d31cfdc9edd302ee63a29125bf5995a72cde63635e5e","observation_id":"32264fd3-342f-4cf2-8bab-114e1826edc3","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Improving visual prompt tuning for self-supervised vision transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:92816a0c461de12e5601ae95762b6deb065f58ce6d079187ca88b2edd5adfb36","observation_id":"f8ca867e-101d-466e-9f94-54a7005685ff","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Facing the elephant in the room: Visual prompt tuning or full finetuning? InThe TwelfthInternational Conference on Learning Representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:56168dfbb0717afa7768528c32831c6f97e862ae13100a305265109844e54266","observation_id":"471dcb08-4089-4f16-b02b-f6e91b0d0eee","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Rethinking spatial dimensions of vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:9da9690c267e939ef67feff9179091440712765b996cc35c6c653170456f7433","observation_id":"6dadc7fb-ce44-41ab-be5b-17fda95acd86","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:c8d934ea12b92ae251e5ad8e1de79cf14a463626aa1e2ab435d8bd9fbaf7033e","observation_id":"3c72e6d1-4087-4451-adb4-ad7670b265f3","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Adapterhub: A framework for adapting transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:e8a1d9f08c2ede2d72f758df9bce963fe1cb4c854b191ff1bbcd8abc474e4e25","observation_id":"157f5af7-dc8f-40e9-b5c0-d3d20d7c3340","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Compacter: Efficient low-rank hypercomplex adapter layers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:e681c6555c8066b68b7b3fdc6f53f5aef5c002acc6ff9a334d437938dcbaa8f2","observation_id":"33aa5c06-7a9c-42c9-aa3e-15c157b39017","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:fdd394b75f0c8a730901ea797cca3c97107b5189fdc6f8f46ebcb76e94c919f2","observation_id":"48173aba-1bea-4084-a6d8-ff770b287db0","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:af1f381bc09532d9b80e543d7e16ed6f3e1e3da431e8f40f4521128477b5958d","observation_id":"52d842b5-b0c3-49cb-b331-15ce60299255","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Autoprompt: Eliciting knowledge from language models with automatically generated prompts","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:aed20944364fe70aee1ebc8a11ecda40dec7b09d2db2351bae56da6307c124ca","observation_id":"65771cdb-1b64-4e0e-893e-cc7613097d0d","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Universal adversarial triggers for attacking and analyzing nlp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:cc243c1c9f6ec61077eeda2534be400cf06a9e6e590806a62ab90be149647282","observation_id":"84cc1709-4a04-4865-a023-a9e7d4e33da9","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Qlora: Efficient finetuning of quantized llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:8e47a508ce5a4f7529ad45cd5869fc1563d67dbf2fa665e800a8c0ec6eddba7a","observation_id":"de1baeff-96e5-4e56-82d0-362c2e14709d","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Bitfit: Simple parameter-efficient fine-tuning for transformer- based masked language-models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:3971469bd6d12ac327aeacb167d651e4e9a435de3ab0528a4c19ebc67effe0b9","observation_id":"86650252-7cef-4148-898c-1eec862dfb3a","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Prompt learns prompt: Exploring knowledge- aware generative prompt collaboration for video captioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:04e1e9ca30a2cc3838769aac74999d8cda62f8700d50001e2e4a7e1f3beb0e95","observation_id":"ea5233a1-bc63-43d0-b771-690ea0db3a04","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Visual instance-aware prompt tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:0179c0a01fa0eb62d04abae169abfe0945e4851a656e0b1e6af8721e60ff0525","observation_id":"d4875d43-800a-4f7a-88d2-c2c8c11036a4","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17650","last_updated":"2025-03-22T04:59:51Z","snapshot_observed_at":"2026-08-07T16:44:34.198121Z","submitted_at":"2025-03-22T04:59:51Z","title":"Visual Variational Autoencoder Prompt Tuning","version":1},"cited_work":{"arxiv_id":"2503.17650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.17650","snapshot_observed_at":"2026-07-04T15:49:56.356391Z","title":"Visual variational autoencoder prompt tuning","venue":null,"work_id":"92456e78-972b-411e-b305-2efd7a5253bf","year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"cited_paper":"/paper/2503.17650","citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:21b09f4ff0020f103888171a6416a845a604b5a248c3817739a032961444f930","observation_id":"78899d35-5ae8-4c5d-bf14-87cc3919893a","resolution":{"observed_at":"2026-07-04T15:49:56.359808Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Pro-vpt: Distribution-adaptive visual prompt tuning via prompt relocation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:f37674e42a04a7171f1a4dab4d8a40eaa83ac9f0a0ff1d4818bc9f6cdb377a80","observation_id":"53142d66-ee38-4ead-b9a0-10485dd4259d","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Cvpt: Cross visual prompt tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:48734b6666157ff940e42b355ac6f81cc77f920a14cf0ddeea0f92aee893a64f","observation_id":"7551ac01-bd74-4a58-8edc-a9a6ccb4549a","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Neural architecture search: A survey","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:ad0c12cacafa30af050ab9b23a1d2292d0e088becc733482d5edaee84757e26d","observation_id":"9c74411e-2211-4a37-ad77-0ffd1d3be7d0","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Autoformer: Searching transformers for visual recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:034445f632ed399efb38cdb9c5649f3414e4c77fff5b0a80e0e75833b0c0882f","observation_id":"7ffffb4b-2cf0-4c81-aa8c-cae8c9a4ec9b","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Vitas: Vision transformer architecture search","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:949dd58087c97e33b2121ae486916414190a92f64e4a2796ba7f474e6b0630ef","observation_id":"954fcd1a-f0c5-40dd-89c7-2b4f75b08e2c","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Nasvit: Neural architecture search for efficient vision transformers with gradient conflict aware supernet training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:0860eec9b13e8158c6f11ff1fd30952a8fc9f8d4b4869d3f8ab4a703d90f978b","observation_id":"c13d4488-7707-405f-adcf-d2f7e1bf0cfc","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Dynamicvit: Efficient vision transformers with dynamic token sparsification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:eaf3d50303a7e42fb973cdb9aa03048292b14626c426e3df14acd3f4b196b004","observation_id":"768b285d-6a13-4269-89fe-1019efd2e517","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Evit: Expediting vision transformers via token reorganizations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:c87bf07f1cbfbd41fe801fceb5c993cd3483759dbb5c98d57f1f6b58ff958c9c","observation_id":"ed2e4629-04d0-478e-9006-4c0093375708","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Advancing textual prompt learning with anchored attributes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:62c74d2653c99133c47c563f2f41ed56882a5caffedc18af58f9cf406167d914","observation_id":"52c7ceed-c6a0-45e3-b11c-cace561507eb","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Differentiable prompt learning for vision language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:3c787b7129b6596a721821318bcb3d9f0981d5f7fb01e0939dbbf400e216a041","observation_id":"85e845f2-aeeb-45ab-a9e4-08e1eec2bfac","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Causation, prediction, and search, volume 81","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:a452309f83d34e9f290b4bf119f6ef52687c0b5af1df036b0de4344cc55a2955","observation_id":"f1e8ba9a-e643-4639-bb11-89bde126f004","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Prompt-based adaptation in large- scale vision models: A survey","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:5169859bc03e9458dd1c9720680b6d75e8220e44511909d588be9211e2f9276f","observation_id":"f4538443-b729-433a-9ff3-bdf0d51ba9e3","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.14228","last_updated":"2026-04-25T07:07:52Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T05:16:50Z","title":"Not All Directions Matter: Towards Structured and Task-Aware Low-Rank Model Adaptation","version":2},"cited_work":{"arxiv_id":"2603.14228","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.14228","snapshot_observed_at":"2026-07-04T15:49:57.322018Z","title":"Not All Directions Matter: Towards Structured and Task-Aware Low-Rank Model Adaptation","venue":"cs.CV","work_id":"21896eef-aa01-418e-8009-5791eb8b0ada","year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"cited_paper":"/paper/2603.14228","citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:cdaada7a0e9800255e11ef2a8fc8c5784c6f31d95bc68485085ca69bb9e55a31","observation_id":"766750cd-e767-4bca-9a6c-87670316aedf","resolution":{"observed_at":"2026-07-04T15:49:56.336184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.02630","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:49:56.352156Z","title":"2510.02630 , archivePrefix=","venue":null,"work_id":"cec78198-713e-4987-933f-870c2ab7fa4c","year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:445b01a30ccd84286164a8d16d1d6fb258f5040601be28f6453c4b3e3800c470","observation_id":"e86da344-6803-4105-badc-bdbc053032ab","resolution":{"observed_at":"2026-07-04T15:49:56.354148Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Ctr-lora: Curvature-aware and trust-region guided low-rank adaptation for large language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:4c48f7f35e38f10d1d4a13996f41816e11dd8f9b02b5ccc3bea4b5c9d1f6450a","observation_id":"eae83ffa-abf4-4904-9a51-8e92360e30ae","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09119","last_updated":"2025-09-11T03:07:05Z","snapshot_observed_at":"2026-08-06T13:35:25.614533Z","submitted_at":"2025-09-11T03:07:05Z","title":"Sensitivity-LoRA: Low-Load Sensitivity-Based Fine-Tuning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.09119","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09119","snapshot_observed_at":"2026-07-04T15:49:56.363031Z","title":"Sensitivity-lora: Low-load sensitivity-based fine-tuning for large language models","venue":null,"work_id":"dbcbdf17-8780-4f8b-9c26-2bb844a1fef8","year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"cited_paper":"/paper/2509.09119","citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:acdbcebe3edb0cf00ced9508763a285c2f01d1f02b97ddaa5146ab293cffd47f","observation_id":"9f8e0147-3310-4849-bac4-e156dba06903","resolution":{"observed_at":"2026-07-04T15:49:56.365368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Prime once, then reprogram locally: An efficient alternative to black-box service model adaptation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:6719441775ba324397502c23ba6f4d53ccad75d604f267bf771895d929a17263","observation_id":"4a1d2452-0f02-48d9-a355-25e350da1239","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Dpcore: Dynamic prompt coreset for continual test-time adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:188ecb5d6f3100d027362a59425795d82c003f2456786c59832777428e91dbf1","observation_id":"dfe7dfde-62b8-4ed2-9c17-c6c548d2f3b8","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Flasheval: Towards fast and accurate evaluation of text-to-image diffusion generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:6a2c2b4d4b73e65876778786b7df0a7de883aae19f775badc2facc546b1a4d66","observation_id":"da33d525-05b0-4cb1-aa98-4b9dbc3aec45","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Thinimg: Cross-modal steganography for presenting talking heads in images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:a4ef1c68621c80c78232f229d5d9abffad7df356460473a4ec1049ebb595b753","observation_id":"dc30faf3-5be6-47e8-93ec-707998913a1d","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Streamvlo: Streaming visual-lidar odometry with cumulative drift compensation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:9f9be007d294b803d4dc03a6a49dc52d615fad397f8229f2181c754d00ea3c3a","observation_id":"e96c0261-c8d3-44c6-ace4-42cc8dce9ff2","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04198","last_updated":"2026-07-01T07:33:13Z","snapshot_observed_at":"2026-07-13T10:56:53.552324Z","submitted_at":"2026-04-05T17:43:16Z","title":"DriveVA: Video Action Models are Zero-Shot Drivers","version":2},"cited_work":{"arxiv_id":"2604.04198","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04198","snapshot_observed_at":"2026-07-04T15:49:56.319991Z","title":"DriveVA: Video Action Models are Zero-Shot Drivers","venue":"cs.CV","work_id":"dadae3a1-3943-4c25-b4e3-557c21c31544","year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"cited_paper":"/paper/2604.04198","citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:dc52df682858f467b17219c035eaa79a3b089134ed8b9be10b5d6a95af522436","observation_id":"cf9a880f-808f-4e6c-90fb-ca1bbb819704","resolution":{"observed_at":"2026-07-04T15:49:56.326328Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Unsupervised hyperspectral image super-resolution via self-supervised modality decoupling","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:452b95605a777e72ec659a910705393aa04b2c349bdf4b2302208e90aeace86b","observation_id":"f50e39c7-fd8f-4e18-90df-bf031510cd77","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Pansharpening for thin-cloud contaminated remote sensing images: a unified framework and benchmark dataset","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:e7539c436cd0c52145ddff6f24256fe01f332b193b65fa1e98ed62c308914580","observation_id":"14045434-a1b7-42ca-af10-cf2b165e21f3","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Frequency-decoupled learning for joint thin-cloud removal and pansharpening","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:181ecfefaf920da7d18dbf27f7a16c39154a9efb0f216b8d61cca485e383d566","observation_id":"be21c393-2e77-4044-aa12-0e4208f45d05","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Semi-supervised semantic segmentation with multi-constraint consistency learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:e8f332a30a85a06c0452c2745055e66f4a2724b3b7df673c3fb9bdd4d00ed969","observation_id":"115c913b-18c6-477b-ab7b-1e2829153aab","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Depmatch: Boosting semi-supervised semantic segmentation by exploring depth difference knowledge","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:5069dbf7dace6cbd9d19eb626061cf5bfd4fb2f0aa011bb8160da9a48284b5cd","observation_id":"f3322269-b8e3-4d52-b826-3bcbf0b20788","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Pca-seg: Revisiting cost aggregation for open-vocabulary semantic and part segmentation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:70451494ced4dcd8f62fa1eadceed9faad95e942a6a7ab6959a39405c39c2f27","observation_id":"456e217f-be52-4420-b04b-ee7d9404666c","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:eebaaac9cacc33d3df6464b235057e322d96a997653a91336a51966e0ab3d34b","observation_id":"7558d2ff-5f0a-4438-a4fc-994bcf620c62","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:d5e14735939488b80ec39e0ba2555311a410bfbbe8a19b841cc42c537bdb5ba8","observation_id":"7774712d-3bc9-446e-9364-ea4cb33181d2","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"This avoids explicit Hessian materialization; memory overhead comes from retaining the graph for the second pass","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:137e03f3b6c408d2d73dedf545828b4648372436b9f195176c72c1914ec0783e","observation_id":"4c221815-c0e7-4123-b478-268459f47346","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"(5) in the main paper that the affine parameters γ, β are generated via MLPs ϕt(s) taking the prompt summary s∈R d as input","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:78fed219a9f23fd5ecc4f5b57420f1b0fa3d5349b58033b6b4627f5083708656","observation_id":"ef31f980-5398-4830-9aee-043472f0cfb9","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"However, standard cross-attention consumes excessive parameters (3×d 2 ≈1.8M)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:d6d1f8b7a6d6ebfcd5b88cc16f4a5153e76d4e11ddd2e47937977ed64fefba22","observation_id":"117f2042-3ca4-4700-a34c-479c4dc5cdb0","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Layer- specific","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:3f39e08650373a04a6db3b8755c6368b837251f8d7018393f692beba106e3bbf","observation_id":"22bd8223-31ca-4b01-b66b-983c37cb8102","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Affine\" and","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:4b1d869ffd7cccfa6494d1f84d7f5f1c085d726112736f7ccc31cfe55e3f023a","observation_id":"2f4eac90-90fb-420e-b068-42692a3ad536","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:27:24.402364Z","title":"Collapse Rate","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-26T01:27:24.402364Z"},"links":{"citing_paper":"/paper/2606.26379"},"observation_digest":"sha256:f6a43b3b0dc9fcf28c7ef20d006359a1016a32e77fcc91ec970d8ed6c6f493ff","observation_id":"95c3b2bd-aff5-44a6-b337-96d326b01709","resolution":{"observed_at":"2026-06-26T01:27:24.402364Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.26379","last_updated":"2026-06-24T21:06:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T09:28:29.089762Z","submitted_at":"2026-06-24T21:06:23Z","title":"Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":80,"verified_exact":7,"verified_fuzzy":0},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 1 inbound Pith citation observation for arXiv:2606.26379."}