{"as_of":"2026-08-11T13:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bcbc972855fd592a9c75bcec773123887c8bf64eabc9a7186b91107798fd997f","coverage":[{"denominator":119,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:54:42.066284Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.06884/citation-record","integrity":"/paper/2501.06884/integrity","json":"/paper/2501.06884/citation-record.json","paper":"/paper/2501.06884"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.286782Z","title":"Multi-task learning as multi-objective optimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.286782Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:2e0997042a031951d05034cddbd0ef7ea2546a528997489ec052446461ef6a13","observation_id":"4c4651b7-0022-43de-b3ee-3abbcf14a428","resolution":{"observed_at":"2026-08-10T20:54:41.286782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.292685Z","title":"Gradient surgery for multi-task learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.292685Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:5dc9c05e708708218ae70854ad11282897b94901bc27ae33423539a57615ff09","observation_id":"d47f0836-9683-4765-8e39-e5fdf9563435","resolution":{"observed_at":"2026-08-10T20:54:41.292685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.297748Z","title":"Conflict-averse gradient descent for multi-task learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.297748Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:9e420d007873bc753012dcba650039c50a84272b05678b90541dfd0325325525","observation_id":"e5539f59-144e-468a-b443-6d057ee9fb01","resolution":{"observed_at":"2026-08-10T20:54:41.297748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.305842Z","title":"M3vit: Mixture-of-experts vision transformer for efficient multi-task learning with model-accelerator co-design","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.305842Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:f7a879951e1f5d6c58fadee51de9fa2d877f17565a0f2180a4e5697791588e70","observation_id":"a48615eb-a9d1-4ac4-ab36-17fc538d9c6b","resolution":{"observed_at":"2026-08-10T20:54:41.305842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.313119Z","title":"Multi-task dense prediction via mixture of low-rank experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.313119Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:b7d5885e316f065b729261f661b56dda229904064eb12abee4ffd7f62ceca629","observation_id":"1f08306d-6ea2-47f4-b88e-1bcaa2ff6101","resolution":{"observed_at":"2026-08-10T20:54:41.313119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.318723Z","title":"An erudite fine-grained visual classification model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.318723Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:c21646807f23b3ca44d761d8608240bc4ff2118ecbbb879598f920ae39418fdc","observation_id":"e113f17a-5677-4c2c-9551-26da116ed99f","resolution":{"observed_at":"2026-08-10T20:54:41.318723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.325345Z","title":"The kalai- smorodinsky solution for many-objective bayesian optimization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.325345Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:e9eacb1cbdf73d37929ebe11109a81a960a4e3a4d82b1b4d173278c84b4cf300","observation_id":"93f74b59-a1ca-44cc-b108-62ca97b5878a","resolution":{"observed_at":"2026-08-10T20:54:41.325345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.331147Z","title":"Self-supervised generalisation with meta auxiliary learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.331147Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:c8fef794ecbe3558cfb524c57504d9f20b77f7fd53fb48526a45f5ca6e3b3f6f","observation_id":"7a793ad6-2864-408b-9688-31b5c4b1c1f4","resolution":{"observed_at":"2026-08-10T20:54:41.331147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.336610Z","title":"Auxiliary learning by implicit differentiation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.336610Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:eabed05eebbb9dfcc129c864fa3655bf2a6c5c7d1435185fcd3d10f4cd7b6158","observation_id":"b3560e56-2ea3-420e-a09d-fbdab30a5e45","resolution":{"observed_at":"2026-08-10T20:54:41.336610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.340866Z","title":"Adamerging: Adaptive model merging for multi-task learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.340866Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:ab6401cfc0f6f12a11275f63ce133ddac7276120e7f053343f96be418a143b94","observation_id":"905e5522-a668-42ae-a035-f8a27d20c705","resolution":{"observed_at":"2026-08-10T20:54:41.340866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.346065Z","title":"Towards impartial multi-task learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.346065Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:4b2b52ae45597cc1584971b1a0a0228ce5f1baec87077e77aa05ec4ea014abc9","observation_id":"6404cd02-33bc-437e-8c4a-bddf16310fc5","resolution":{"observed_at":"2026-08-10T20:54:41.346065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.350580Z","title":"Modeling task relationships in multi-task learning with multi-gate mixture-of-experts","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.350580Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:3d628ab4d480ab6e6b62d27acd164fd8216b2bb18d7adfa771a703aba6a68e8b","observation_id":"6d0ee314-d1f3-4b16-977f-a31c7e848506","resolution":{"observed_at":"2026-08-10T20:54:41.350580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.354978Z","title":"Mod-squad: Designing mixtures of experts as modular multi-task learners","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.354978Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:138dfa779118c8509d9694208cc9b65f5265990480518a8ed3beddf099832ad3","observation_id":"8cabe87c-0062-44e2-b96c-1068f3be6b5c","resolution":{"observed_at":"2026-08-10T20:54:41.354978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.359628Z","title":"When moe meets llms: Parameter efficient fine-tuning for multi-task medical ap- plications","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.359628Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:9ad796ca4adbacf39d83ad8ca2b0d48b4b691f00350141e2f842fe3a60cdad76","observation_id":"4389087e-c573-41c3-b960-9d036e490efc","resolution":{"observed_at":"2026-08-10T20:54:41.359628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.364938Z","title":"Adaptive mixtures of local experts","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.364938Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:3578ee07122426a73e59b753fd4960b93fb51cf89e7e2411c837e05044f229a9","observation_id":"454bcf69-2ddc-4096-860c-fc080727589c","resolution":{"observed_at":"2026-08-10T20:54:41.364938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.369622Z","title":"Learning piecewise control strategies in a modular neural network architecture","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.369622Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:4c0257463e803e1b171c4eef9b26cac8e91d0ab486766bfabb4525cefeecb763","observation_id":"f5d52588-ca33-4f4d-b4b5-ed029f0c4a2c","resolution":{"observed_at":"2026-08-10T20:54:41.369622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-10T20:54:41.374198Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.374198Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:ee41040a4052650c0ee401c4584a007ce1df88b022ea6b5da6bc67cd1ebce354","observation_id":"5ab13bcb-1c55-4feb-a225-051384c00371","resolution":{"observed_at":"2026-08-10T20:54:41.374198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.380148Z","title":"Belongie, Bharath Hariha- ran, and Ser-Nam Lim","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.380148Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:8f50988caf2f2408c816de1f3b2f205ccb49dab98465cee6cc3a3046dd88726e","observation_id":"77a5f130-fd71-4ede-8854-fd0653e6fd48","resolution":{"observed_at":"2026-08-10T20:54:41.380148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.388346Z","title":"Scaling & shifting your features: A new baseline for efficient model tuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.388346Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:4e60618791d8fe543d5f149f2a51d1cecf704c1e00c512dd35487c3a4124d147","observation_id":"dbcbde73-b6be-47f1-8ade-8e4804475915","resolution":{"observed_at":"2026-08-10T20:54:41.388346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.393231Z","title":"Efficient adaptation of large vision transformer via adapter re-composing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.393231Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:e75f0651f01f0c547882166f49e89d69e9ac458fcc11876770b90c713b362d52","observation_id":"70c77462-b39b-4d9e-ada6-543845633203","resolution":{"observed_at":"2026-08-10T20:54:41.393231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.398756Z","title":"Compressed video prompt tuning.Advances in Neural Information Processing Systems, 36:31895–31907, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.398756Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:7393e8c6b94c87417f22b77b2a6424af5049176231acec9aadb0aa5888199b94","observation_id":"cf4d96a9-e6d2-4a15-8848-203f7de5bda4","resolution":{"observed_at":"2026-08-10T20:54:41.398756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.403284Z","title":"Gradnorm: Gra- dient normalization for adaptive loss balancing in deep multitask networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.403284Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:a53a6975db2794324b4d97467af77b9b9f0c75e7235c9091a9cbd0feaba12a94","observation_id":"d909dfb6-569a-4d9c-8fd7-a2ab82c86ec5","resolution":{"observed_at":"2026-08-10T20:54:41.403284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05874","last_updated":"2020-10-12T17:26:34Z","snapshot_observed_at":"2026-08-09T13:19:30.075014Z","submitted_at":"2020-10-12T17:26:34Z","title":"Gradient Vaccine: Investigating and Improving Multi-task Optimization in Massively Multilingual Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.05874","snapshot_observed_at":"2026-08-10T20:54:41.408096Z","title":"Gradient vaccine: Investigating and improving multi-task optimization in massively multilingual models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.408096Z"},"links":{"cited_paper":"/paper/2010.05874","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:77b5c30c1c4aad64c34a3df32ade7adfc9f676294dd68065fc8a5a27416f0c5c","observation_id":"8cd0c647-d02d-4a2e-9e5f-38a41b57c7ff","resolution":{"observed_at":"2026-08-10T20:54:41.408096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.413688Z","title":"Multi-task learning as a bargaining game","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.413688Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:f407358cbc14bc733538283e370eeb94ec368a679736bc20845d4351ff8e4502","observation_id":"64c8d6e8-5e42-42b7-aa1a-bf7d63cf5391","resolution":{"observed_at":"2026-08-10T20:54:41.413688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.420202Z","title":"Independent component alignment for multi-task learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.420202Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:603beb1752192f77ef4d4abf623592a123d764a9ea4833ad982201e711da9c51","observation_id":"60258c7d-5cee-4bef-a74d-375d4d874e45","resolution":{"observed_at":"2026-08-10T20:54:41.420202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.425119Z","title":"Multinet++: Multi-stream feature aggregation and geometric loss strategy for multi-task learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.425119Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:5b7ed269f9a50ad33d9defb6a034c2fa9f5d45a634bbbd1115eab9346ff6530d","observation_id":"71161548-44c7-4bea-b003-721dfd7e6a5a","resolution":{"observed_at":"2026-08-10T20:54:41.425119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.432296Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.432296Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:38096685077f34617b457779742d2f284c38333c3111d6d67426680d412f166f","observation_id":"3f234c4c-adbc-4531-b7e3-105f3a53c1fb","resolution":{"observed_at":"2026-08-10T20:54:41.432296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.437583Z","title":"End-to-end multi-task learning with attention","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.437583Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:ef83e9fe43e14ec07ff9c39e012429492cfbb75da567e55b41af390ccd1132cf","observation_id":"772f4d71-16f3-4476-9025-e78f1d973a37","resolution":{"observed_at":"2026-08-10T20:54:41.437583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.442038Z","title":"Achievement-based training progress balancing for multi-task learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.442038Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:ca52be1ba648c8275ece70f7f646e630377f42bf79179a03f6243e5b89a47b92","observation_id":"55816b7a-3ac0-41a4-ba91-2753e9d61358","resolution":{"observed_at":"2026-08-10T20:54:41.442038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.448512Z","title":"Moefication: Transformer feed-forward layers are mixtures of experts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.448512Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:7befae8201dd00992a04a98d6ccde54792ba8780f4d32643e4e329deb5ae654b","observation_id":"41ada5e1-46a3-481a-a5c9-69955b88ed63","resolution":{"observed_at":"2026-08-10T20:54:41.448512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04361","last_updated":"2024-11-12T13:35:37Z","snapshot_observed_at":"2026-08-04T22:34:19.116719Z","submitted_at":"2023-10-06T16:34:51Z","title":"Exploiting Activation Sparsity with Dense to Dynamic-k Mixture-of-Experts Conversion","version":4},"cited_work":{"arxiv_id":"2310.04361","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.04361","snapshot_observed_at":"2026-08-10T20:54:42.594045Z","title":"Exploiting Activation Sparsity with Dense to Dynamic-k Mixture-of-Experts Conversion","venue":"cs.LG","work_id":"dad6cbb1-a3d5-4316-a3e6-d2a4a93d1067","year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.453566Z"},"links":{"cited_paper":"/paper/2310.04361","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:7e510869e76334732ddc2a92c39327f9a6141c1e7f3e5bdf5cd46e39aefcfe2f","observation_id":"1a024779-0bef-473a-aa9b-b543c667efb6","resolution":{"observed_at":"2026-08-10T20:54:42.605414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.459784Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.459784Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:534dfe9861de679ce64fe4f0658d3575f3edabfcbf5a0d9910ce62318ae92712","observation_id":"100fba37-ede6-4bbf-85e9-655946348c25","resolution":{"observed_at":"2026-08-10T20:54:41.459784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.464831Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.464831Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:8317cf189ccc5c9fc362093de119f0c108888cfaedf0e980ee9f858e2b4dd5ce","observation_id":"31dd4f62-f46f-4209-9648-0240a0946dab","resolution":{"observed_at":"2026-08-10T20:54:41.464831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.471037Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.471037Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:4a37ac62cf7c1e71c9cff4d939c92811c320f4dccddc5b3367629519124674f7","observation_id":"61b6844f-d474-44db-b346-c387e744e53c","resolution":{"observed_at":"2026-08-10T20:54:41.471037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.478565Z","title":"Transformer feed-forward layers are key-value memories","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.478565Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:d597659ac2fc6c42372a519fa7447badb6cb87a4bab0587a520d5f80ff536077","observation_id":"6750cf1d-f583-4017-ac79-662d3906e85d","resolution":{"observed_at":"2026-08-10T20:54:41.478565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.487224Z","title":"Knowledge neurons in pretrained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.487224Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:1404ab250b42784b05aa87b35ac783c5a79305d4895fd35ad9e10c7b32c20aaf","observation_id":"d41e453b-90f2-4c65-9330-f1e2825b4e72","resolution":{"observed_at":"2026-08-10T20:54:41.487224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.491907Z","title":"Balanced k-means for clustering","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.491907Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:4ea7a9a82486c2526e17d337ec736b4eb390f50dbb7615c28e158b9746a2972d","observation_id":"7f330f1d-f586-49fc-966b-3d0f819ee85c","resolution":{"observed_at":"2026-08-10T20:54:41.491907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-10T20:54:41.499157Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.499157Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:6241eaf18a733b47c1635b65546eb45bd49c9e969acff49f49b1b063bb1194e1","observation_id":"8e89fec7-320f-41a2-ba95-fb18e73c1c0d","resolution":{"observed_at":"2026-08-10T20:54:41.499157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.509874Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.509874Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:a5301180949f0aa5a547a993870b73cbba3f5b5985b608ef3475b00cb93538e5","observation_id":"3f8ecdb2-8554-40ee-b8b4-a9e4da9cd16f","resolution":{"observed_at":"2026-08-10T20:54:41.509874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.522906Z","title":"Fine- grained car detection for visual census estimation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.522906Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:0e17ae77fde572fd94adbe5cf496b1cca43a80145f167a22c9ba1596ee5bd5fd","observation_id":"e50f9184-f6d9-4a64-a039-b20d2d219d14","resolution":{"observed_at":"2026-08-10T20:54:41.522906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-10T20:54:41.528260Z","title":"Fine- grained visual classification of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.528260Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:a9171ed1d042caf49c2673924a9a9d96772575561e1bf476cf8b956249d87649","observation_id":"aa205ecf-1df3-4fa3-b420-2d4d2ba020eb","resolution":{"observed_at":"2026-08-10T20:54:41.528260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.532559Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.532559Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:e2fcc862f027f77a610179745ce6e9edf6b476c7c938c4c09ad4c3f1c14a4bba","observation_id":"aded42a4-642c-441f-bf92-5911a1ee11ec","resolution":{"observed_at":"2026-08-10T20:54:41.532559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04867","last_updated":"2020-02-21T13:36:15Z","snapshot_observed_at":"2026-08-09T06:48:42.729935Z","submitted_at":"2019-10-01T17:06:29Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04867","snapshot_observed_at":"2026-08-10T20:54:41.681764Z","title":"A large-scale study of representation learning with the visual task adaptation benchmark","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.681764Z"},"links":{"cited_paper":"/paper/1910.04867","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:e70300d375acb97e002bdea856c61edb03a519286b3a93b07761949e0d7398e4","observation_id":"98eb2861-1640-4139-b127-dfecf164d1ad","resolution":{"observed_at":"2026-08-10T20:54:41.681764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.689763Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.689763Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:b5ee91875c1b0b9c2b294f8f6e997e6e6e9e8664416999fe110f60cc80f4e1f3","observation_id":"da18ec33-2af1-498f-9dc6-21d46510c5fd","resolution":{"observed_at":"2026-08-10T20:54:41.689763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.698927Z","title":"Taskprompter: Spatial-channel multi-task prompting for dense scene understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.698927Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:396f3803bd8ae2d0edab16579ed745e96ea7396fa6521303ebf03c5c3e602a1a","observation_id":"d39829b5-1b32-4289-b28a-8d03bca2af9d","resolution":{"observed_at":"2026-08-10T20:54:41.698927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.703652Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.703652Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:164d952756693724db7c2e4a947638f0f3ba24335b527382ee1874de10bc247f","observation_id":"52477772-529c-4656-932a-86f1c0bd5664","resolution":{"observed_at":"2026-08-10T20:54:41.703652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04673","last_updated":"2022-06-14T12:15:55Z","snapshot_observed_at":"2026-08-11T03:48:11.885296Z","submitted_at":"2022-06-09T17:59:58Z","title":"Neural Prompt Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04673","snapshot_observed_at":"2026-08-10T20:54:41.708275Z","title":"Neural prompt search","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.708275Z"},"links":{"cited_paper":"/paper/2206.04673","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:6b7710dcace92ead6a3febf568f3fdae7528c3db50fd4b1100440fdd007e436b","observation_id":"cb0e8449-71dc-4958-9da2-5738d866fa8c","resolution":{"observed_at":"2026-08-10T20:54:41.708275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.772576Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"1cf98fc3-3f9c-4df7-8620-4b66500af335","year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.714498Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:cbd2880e6d55bb7f01923035c3f55500c1c022e021ebd435a76ab800897ff320","observation_id":"8abaf84a-2cd6-482a-9f53-2740f0fd15df","resolution":{"observed_at":"2026-08-10T20:54:43.777660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.755062Z","title":"Dualprompt: Complementary prompting for rehearsal-free continual learning","venue":null,"work_id":"e086d39b-a78b-4ffc-b535-ab7390f957b4","year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.719758Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:0b6c6abda0c95c2d2aa338ed0b84bf2684ec9b55733c95ad5e2e91aa795252a7","observation_id":"df4801eb-8b09-4139-a4f0-c1e0e44c7209","resolution":{"observed_at":"2026-08-10T20:54:43.760553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.739984Z","title":"Parameter-efficient transfer learning for NLP","venue":null,"work_id":"7c1c8734-8531-4de8-8b38-05a42808405b","year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.725363Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:878148fac3fd12800ac8d6d1a3bc58daa0855291d70809d5a8b326d74d697199","observation_id":"dea8e74b-a66e-4129-b5d0-3718a2408e1f","resolution":{"observed_at":"2026-08-10T20:54:43.744731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.730622Z","title":"Sensitivity-aware visual parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.730622Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:557265ce03c6cfb000404efe5404508a8053c6ce1c47259f37a78f2ff5d6fc48","observation_id":"0b4e6dc4-b596-4b3e-ad3c-7aa67fd19597","resolution":{"observed_at":"2026-08-10T20:54:41.730622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.705182Z","title":null,"venue":null,"work_id":"a0b4d2f0-385b-4fc7-9ff2-cc84612270ee","year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.734878Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:19e3acaee4bcb82546c97d5494a86e418a279cfc51cc28f3eb3a9e058e55c6da","observation_id":"982f8b97-5676-4a0a-a63f-3dcdaddad3fb","resolution":{"observed_at":"2026-08-10T20:54:43.710266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.739692Z","title":"Multitask learning","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.739692Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:57e9ad457158a42fc0afd7cdeaf164a745a8c89a4b91241c220c39fb25d15477","observation_id":"b5694ef4-7b38-498f-b3d0-5a59495dfd31","resolution":{"observed_at":"2026-08-10T20:54:41.739692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09796","last_updated":"2020-09-10T19:31:04Z","snapshot_observed_at":"2026-08-09T08:30:49.737024Z","submitted_at":"2020-09-10T19:31:04Z","title":"Multi-Task Learning with Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09796","snapshot_observed_at":"2026-08-10T20:54:41.745336Z","title":"Multi-task learning with deep neural networks: A survey","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.745336Z"},"links":{"cited_paper":"/paper/2009.09796","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:9d8fbc3c9770fe1ffca28899e39cb934a0803e4cd44ec682af5a433f1f88e981","observation_id":"48f75bde-94b1-4f07-9acb-0ce0c59c8ef7","resolution":{"observed_at":"2026-08-10T20:54:41.745336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05098","last_updated":"2017-06-15T21:38:12Z","snapshot_observed_at":"2026-08-11T03:54:05.796121Z","submitted_at":"2017-06-15T21:38:12Z","title":"An Overview of Multi-Task Learning in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05098","snapshot_observed_at":"2026-08-10T20:54:41.752027Z","title":"An overview of multi-task learning in deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.752027Z"},"links":{"cited_paper":"/paper/1706.05098","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:7d65b0397056e6fe6fffed9bb4495266b00f1f12cf0516671208d820fe50441c","observation_id":"385eadde-b21a-466f-8e8a-c3083d13102e","resolution":{"observed_at":"2026-08-10T20:54:41.752027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.675902Z","title":"Multi-task learning for dense prediction tasks: A survey","venue":null,"work_id":"17a47557-a203-470b-ac66-0ab891e3cd10","year":2021},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.759023Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:913e452d7a434dbf7d082f2d7c1b1a5b24f822e4d692268a91fab09f71fff01d","observation_id":"73da6b1d-544e-49ab-9355-baaf770dd9df","resolution":{"observed_at":"2026-08-10T20:54:43.681055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.662236Z","title":"Nddr-cnn: Layerwise feature fusing in multi-task cnns by neural discriminative dimensionality reduction","venue":null,"work_id":"aac43a48-9cff-4b70-97e4-981527510a92","year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.766247Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:acdbbd2f0583e0d0d3f7911b480a9fe16e0c7c98ce8f7c8a0024bc746b2360f5","observation_id":"2203db71-e19a-406e-a10e-f8dc01066671","resolution":{"observed_at":"2026-08-10T20:54:43.666925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.648478Z","title":"Cross-stitch networks for multi-task learning","venue":null,"work_id":"081c9fb6-6d28-43ed-8970-e261b00bfa2a","year":2016},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.774680Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:bc89f1662a7c31e3f74022f5b955966dbb1d71e72a2bd82c9d1f6d1a8e7aa58e","observation_id":"ffc61c11-6b54-4fe9-9122-5fd36c043ed9","resolution":{"observed_at":"2026-08-10T20:54:43.653279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.631245Z","title":"Latent multi- task architecture learning","venue":null,"work_id":"f7326230-9abd-4c9f-8966-3803edd33eba","year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.781753Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:4256924f5d2be311a617f2d2797dbf82380dc4ef91f7f751f98a67a05d176fd5","observation_id":"8cd6ade9-967f-4e43-b943-a4f0e9b59b43","resolution":{"observed_at":"2026-08-10T20:54:43.637251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.10292","last_updated":"2021-05-11T17:58:18Z","snapshot_observed_at":"2026-08-09T03:02:09.246139Z","submitted_at":"2020-08-24T09:49:19Z","title":"Automated Search for Resource-Efficient Branched Multi-Task Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.10292","snapshot_observed_at":"2026-08-10T20:54:41.789012Z","title":"Automated search for resource-efficient branched multi-task networks","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.789012Z"},"links":{"cited_paper":"/paper/2008.10292","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:65944d133a3ffd3c6158318f67ee1ec11dc2a4186711bae8ade37b8dc4ef926b","observation_id":"b42b3d24-48a9-4b5c-be10-94ab3a0b90c8","resolution":{"observed_at":"2026-08-10T20:54:41.789012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.607526Z","title":"Learning to branch for multi-task learning","venue":null,"work_id":"a3773b2b-1fdc-4eae-aa0a-be78513aecf6","year":2020},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.794777Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:65b51b0c64546f2df1588f4225e73bd8f6061ee4b7d6b059390a3ff73be6af2b","observation_id":"d00baac8-3dac-4c5d-ba30-e7167e70840c","resolution":{"observed_at":"2026-08-10T20:54:43.615489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.585556Z","title":"Multi-task learning using uncertainty to weigh losses for scene geometry and semantics","venue":null,"work_id":"42ecb388-8367-4b24-8ecb-975ae5fe3397","year":2018},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.801060Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:0ca6b91ed810ac062b1ff45dc5ae211aabfbfd1b77204de340c01160ff9658f1","observation_id":"4cd496a5-a504-4f96-8cc7-692fdefbb952","resolution":{"observed_at":"2026-08-10T20:54:43.590153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.562639Z","title":"Exploring relational context for multi-task dense prediction","venue":null,"work_id":"93cfb26e-80ab-4903-8e3d-0f29c8143c5e","year":2021},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.807083Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:eeb7a0acc81d2f7eca92b8f69090f2cb72d1161999adb66df9f626df07a8c711","observation_id":"30572065-d442-4699-bc33-9e7ceeb2a7b2","resolution":{"observed_at":"2026-08-10T20:54:43.568445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.544755Z","title":"Mti-net: Multi-scale task interaction networks for multi-task learning","venue":null,"work_id":"9960a466-1be5-4f62-8461-d15cb8ebefa5","year":2020},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.814125Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:b1fcc034ef8e4acdc4564ca66dc6f3ae915b9e8c703efd237162c13490142699","observation_id":"0f891b12-0e9c-4307-a0fd-418e388c41b3","resolution":{"observed_at":"2026-08-10T20:54:43.549629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.527680Z","title":"Pattern-structure diffusion for multi-task learning","venue":null,"work_id":"a50535af-436f-46fc-bdf8-f1e6f55166f0","year":2020},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.819499Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:100b958c984985b24c871135ba4fed9fff7e9eee4be6576f195b6a985a0f6f63","observation_id":"913aed75-2a7f-421a-9e1d-ef4d2fa616ec","resolution":{"observed_at":"2026-08-10T20:54:43.533017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.504482Z","title":"Pattern-affinitive propagation across depth, surface normal and semantic segmentation","venue":null,"work_id":"e76c36d9-c0e8-47fb-a116-58b2107c313a","year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.824380Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:3ae5ce7aa4fbde491a32c02784621b1316ce12f77820d30351d2c480018d0067","observation_id":"fa6d4565-664c-4ed0-9273-3b642c234553","resolution":{"observed_at":"2026-08-10T20:54:43.512615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.484600Z","title":"Joint task- recursive learning for semantic segmentation and depth estimation","venue":null,"work_id":"ca2d7052-cd09-4c4c-be98-f2719b9a2be1","year":2018},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.830370Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:87a8785d7cf41a420c71f397368fb70d1bd5a1fa9f6dde99730f6752cb8a347d","observation_id":"997421fc-42da-4662-a4ef-fe65d46c0392","resolution":{"observed_at":"2026-08-10T20:54:43.491946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.468444Z","title":"Robust learning through cross-task consistency","venue":null,"work_id":"eed2181a-0587-4853-90a5-d69fc2504b80","year":2020},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.835663Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:6644ef34cfe84a0ad96e5060bc8fc64f460d125a63cf3af5b6f62d6952add53f","observation_id":"a253e6fb-6b7a-4c8f-903b-a688907af030","resolution":{"observed_at":"2026-08-10T20:54:43.473498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.841596Z","title":"Learning to prompt for continual learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.841596Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:df4b1f872d630d08ef5a0147f626c018d5788f8bdd0fed2620c9ad9f88d66d6b","observation_id":"b7e408b3-2c70-456b-ac4b-4ae8a887caa2","resolution":{"observed_at":"2026-08-10T20:54:41.841596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.439833Z","title":"Just pick a sign: Optimizing deep multitask models with gradient sign dropout","venue":null,"work_id":"c5d8aaa2-34c1-4235-aa87-076270df37b7","year":2020},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.848439Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:8e34884042992e0181c5a647e657f757ee8b2fc3b085f4ca6e42d6278596a34a","observation_id":"579554ad-383f-4368-b550-6a9480054950","resolution":{"observed_at":"2026-08-10T20:54:43.444934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.423601Z","title":"Dynamic task prioritization for multitask learning","venue":null,"work_id":"476286aa-8762-46e0-903c-5f2c86c36c3b","year":2018},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.855354Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:78520de7b024464827b6658cba2e85b388748d02927dc55ae0be744c3ae6f770","observation_id":"10888fbc-39a3-41da-9efb-e82e67fb7b76","resolution":{"observed_at":"2026-08-10T20:54:43.429116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.405684Z","title":"A modulation module for multi-task learning with applications in image retrieval","venue":null,"work_id":"9a2027e6-8237-4a33-b26d-60e1b6709ed6","year":2018},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.861389Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:272847f65c4980df0545979faf140f3174118a969dfa87dc503323f6196ea6fa","observation_id":"80aa96eb-949b-4efb-b73e-f4d87165ed39","resolution":{"observed_at":"2026-08-10T20:54:43.410524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.388365Z","title":"Contrastive multi-task dense prediction","venue":null,"work_id":"74c3151b-5989-45c0-9652-affb35915a4a","year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.869454Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:9fb292b70ebe5be8642481ec396ec33b847520eb4433c0aa3e64818f744a8604","observation_id":"fb67c2d1-88e9-43d7-8a0d-75886a80eb14","resolution":{"observed_at":"2026-08-10T20:54:43.394460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.372555Z","title":"Learning multiple dense prediction tasks from partially annotated data","venue":null,"work_id":"dd2ffff5-54d4-413a-8346-561045c24f78","year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.876674Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:cad5de01afc4a8b3180a9b9bc6504c9be2b52844ecbeb8fb6e4e20c6f12cff91","observation_id":"af52bdfa-2f91-4895-8610-b9beba3f0f6e","resolution":{"observed_at":"2026-08-10T20:54:43.377637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.352227Z","title":"Asynchronous convergence in multi-task learning via knowledge distillation from converged tasks","venue":null,"work_id":"39a0ff93-c52e-46e3-a989-42e12829d989","year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.883651Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:349bd5835f1e90ae8d827a8e038ded3956a522c99a27a848f31af41ddd9c8467","observation_id":"b047b2df-6d1e-41f0-a4b0-39d12b6a2cd1","resolution":{"observed_at":"2026-08-10T20:54:43.356990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:41.892560Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.892560Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:1802f7be6c5111f04711981300d015b6f8530212fdccaa58aca766d371097c68","observation_id":"0dd57eb4-6937-4ab4-b9cb-356baf85f74c","resolution":{"observed_at":"2026-08-10T20:54:41.892560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-08-07T09:27:36.420559Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-08-10T20:54:41.900952Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.900952Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:538130a5bdc159ad95bbc7ae460dbfc04ee09b602a0b62b130f702e8024a8794","observation_id":"40493273-3ef5-4963-905a-2814829bd3f8","resolution":{"observed_at":"2026-08-10T20:54:41.900952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04260","last_updated":"2022-02-03T21:26:25Z","snapshot_observed_at":"2026-07-06T11:55:57.117755Z","submitted_at":"2021-10-08T17:15:47Z","title":"Taming Sparsely Activated Transformer with Stochastic Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04260","snapshot_observed_at":"2026-08-10T20:54:41.906572Z","title":"Taming sparsely activated transformer with stochastic experts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.906572Z"},"links":{"cited_paper":"/paper/2110.04260","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:d94fdf09822d25f7c717b94bfc8df3a310c5969b623405a8f66943c0063a57a3","observation_id":"b59191aa-fddc-4ba4-b15e-aea3f8979729","resolution":{"observed_at":"2026-08-10T20:54:41.906572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.329646Z","title":"Taskexpert: Dynamically assembling multi-task representations with memorial mixture-of-experts","venue":null,"work_id":"12e5df3b-ee47-4990-96b1-c23c4ac83090","year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.913247Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:d42f1ad2342b9de0f8f26fa9e077b9c3193407e7ea8e1d57b6213627d0077e27","observation_id":"5ef461d8-ec4a-47f6-b95b-6cbbb89f0051","resolution":{"observed_at":"2026-08-10T20:54:43.334689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.315163Z","title":"Fact: Factor-tuning for lightweight adaptation on vision transformer","venue":null,"work_id":"ed81c138-946b-4bf3-b224-88702b1a04f6","year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.924158Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:952477a8c595dcd434bd65c84a589d91c00045f27aae4cfb6bb31181baa6c48c","observation_id":"6be9bc2d-3ccf-4562-a2a8-f0c05d6ca3ef","resolution":{"observed_at":"2026-08-10T20:54:43.320191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.299875Z","title":"Polyhistor: Parameter- efficient multi-task adaptation for dense vision tasks","venue":null,"work_id":"a589f63f-bf5d-41e0-a262-f49a1c20c8ce","year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.929692Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:5f67c9fdcd3b26fbfe260bd4489f442adf2a075d0ed0b798593f1ef2c8eaa227","observation_id":"1961d210-4d1d-40a4-b38c-a704c3403a0e","resolution":{"observed_at":"2026-08-10T20:54:43.304651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.285679Z","title":"Vl-adapter: Parameter-efficient transfer learning for vision-and-language tasks","venue":null,"work_id":"724f2313-a2c5-4e4c-b318-0a0b6c0e8a0f","year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.936980Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:658b521abe54f0fb4bc18e2ef050f47d2d63dc013bb4c50afb7716870c99a473","observation_id":"5048beed-6556-46d9-8b93-aa90b8f84a11","resolution":{"observed_at":"2026-08-10T20:54:43.289895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.13255","last_updated":"2020-12-22T07:42:30Z","snapshot_observed_at":"2026-08-11T03:48:13.950835Z","submitted_at":"2020-12-22T07:42:30Z","title":"Intrinsic Dimensionality Explains the Effectiveness of Language Model Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.13255","snapshot_observed_at":"2026-08-10T20:54:41.942847Z","title":"Intrinsic dimensionality explains the effectiveness of language model fine-tuning","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.942847Z"},"links":{"cited_paper":"/paper/2012.13255","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:04ca70211a652f9bd9880a4ccca9a5c22b7975465b3d6e5af9e88c5b77aec148","observation_id":"92b66a43-03a2-4428-9e1c-e5d8a30b9cc9","resolution":{"observed_at":"2026-08-10T20:54:41.942847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.266676Z","title":"Low-rank compression of neural nets: Learning the rank of each layer","venue":null,"work_id":"9b1241ed-a313-4ede-9f16-7e1deae7f647","year":2020},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.948531Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:59c334d388ba4b58c360fd73ff6b8c41986e6d5dc11e676262cd3f1223fcf15c","observation_id":"3733cf8e-811f-47fd-b0c9-aa58c35dfb55","resolution":{"observed_at":"2026-08-10T20:54:43.272767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.252545Z","title":"Multi-task learning with low rank attribute embedding for person re-identification","venue":null,"work_id":"43fc4c72-9f4f-4d28-a307-ea4855023db8","year":2015},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.953435Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:0d7082d180be8d99b8fb721db71313f2d4078b98a64630c37ad4c8cdc1e086eb","observation_id":"769460c3-ab03-4634-baee-83b3d1ae54e7","resolution":{"observed_at":"2026-08-10T20:54:43.256981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.236584Z","title":"Generalized low rank models","venue":null,"work_id":"bf5e0460-23dc-47d8-93bc-de707e9a3472","year":2016},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.958090Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:c8c256a45c293871b0b3d5ad60babf5f8bc6a18f4cb6b4502c0b7a8cb4ffa193","observation_id":"983e16c0-70e8-4e3b-98ad-63d39fa292cd","resolution":{"observed_at":"2026-08-10T20:54:43.243345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.04038","last_updated":"2017-02-17T01:33:17Z","snapshot_observed_at":"2026-08-01T20:49:41.948448Z","submitted_at":"2016-06-13T17:15:43Z","title":"Trace Norm Regularised Deep Multi-Task Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.04038","snapshot_observed_at":"2026-08-10T20:54:41.963481Z","title":"Trace norm regularised deep multi-task learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.963481Z"},"links":{"cited_paper":"/paper/1606.04038","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:e81719ee620b19fa91a1da5262e80a9ccea8fd522f967e510d10f2117a692fcf","observation_id":"941da6c2-cbad-42f4-8a71-55a4b589fc43","resolution":{"observed_at":"2026-08-10T20:54:41.963481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13269","last_updated":"2024-08-19T03:31:19Z","snapshot_observed_at":"2026-07-06T15:58:08.777051Z","submitted_at":"2023-07-25T05:39:21Z","title":"LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13269","snapshot_observed_at":"2026-08-10T20:54:41.971267Z","title":"Lo- rahub: Efficient cross-task generalization via dynamic lora composition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.971267Z"},"links":{"cited_paper":"/paper/2307.13269","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:58522cab77d94f5b789f0317d4a695ce5cd3179fcd12e3db67c5c27bef8497e9","observation_id":"0e1d72ab-516c-4222-99fe-4814b8b21b84","resolution":{"observed_at":"2026-08-10T20:54:41.971267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12379","last_updated":"2024-07-04T02:55:57Z","snapshot_observed_at":"2026-07-06T17:05:27.005904Z","submitted_at":"2023-12-19T18:11:19Z","title":"Mixture of Cluster-conditional LoRA Experts for Vision-language Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12379","snapshot_observed_at":"2026-08-10T20:54:41.978828Z","title":"Mixture of cluster-conditional lora experts for vision-language instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.978828Z"},"links":{"cited_paper":"/paper/2312.12379","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:b4b7d274612669aa5e7985c658846849877df274047995bad08410a98791a6bb","observation_id":"bbdb1794-01e2-40f7-ac60-8add2876eab5","resolution":{"observed_at":"2026-08-10T20:54:41.978828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09979","last_updated":"2024-03-08T13:13:54Z","snapshot_observed_at":"2026-07-06T17:03:02.786273Z","submitted_at":"2023-12-15T17:45:06Z","title":"LoRAMoE: Alleviate World Knowledge Forgetting in Large Language Models via MoE-Style Plugin","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09979","snapshot_observed_at":"2026-08-10T20:54:41.985202Z","title":"Loramoe: Revolutionizing mixture of experts for maintaining world knowledge in language model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.985202Z"},"links":{"cited_paper":"/paper/2312.09979","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:74a9cbc86f5ab451709eefc322c5690cde77deaba54d60f6e2a0b27b2a03cb1f","observation_id":"a848c388-ba9b-44a7-9889-44aab64c5988","resolution":{"observed_at":"2026-08-10T20:54:41.985202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.220561Z","title":"Octavius: Mitigating task interference in mllms via lora-moe","venue":null,"work_id":"e6a34ad2-1fdd-46cb-8491-feb5ebbac723","year":2024},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:41.998267Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:96dcd78e61aabb09bc6620def89cc347870ded15fb657272fc28c03a5ffd925e","observation_id":"95dbaa5b-eea2-43ef-96b5-fa21cb49bb3e","resolution":{"observed_at":"2026-08-10T20:54:43.225343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.201734Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":"e3c43c3e-8618-4a12-8d33-791fb7bae761","year":2024},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.007569Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:f40f1bf9c103a4f8e0d1e3d4a359eb1090b0e862d27c1a64c764f7e7806edb0b","observation_id":"5dd71e32-1b31-40ee-96b8-8155d664af6b","resolution":{"observed_at":"2026-08-10T20:54:43.207153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.185170Z","title":"Bitfit: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":"f1d80cc8-124f-4430-8a82-8cda8fefba18","year":2022},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.015036Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:519bcb038b986bdbe90c5a132d9807cc386d4f3b1473c78f141c11ba5c9d1456","observation_id":"f87e99d8-e117-4521-a725-66a3a16de4c6","resolution":{"observed_at":"2026-08-10T20:54:43.191158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07967","last_updated":"2023-10-16T15:52:20Z","snapshot_observed_at":"2026-08-09T19:05:22.405576Z","submitted_at":"2023-06-13T17:59:32Z","title":"One-for-All: Generalized LoRA for Parameter-Efficient Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07967","snapshot_observed_at":"2026-08-10T20:54:42.021963Z","title":"One-for-all: Generalized lora for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.021963Z"},"links":{"cited_paper":"/paper/2306.07967","citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:f6350915420568db2b19a6ceca7273c7cfca92c5dca9bfce1553d08aedf091f8","observation_id":"efb56053-6460-4c73-8c1b-35ccb0220635","resolution":{"observed_at":"2026-08-10T20:54:42.021963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.169295Z","title":"Controlling text-to-image diffusion by orthogonal finetuning","venue":null,"work_id":"f742b4c3-d198-4801-95eb-327bdfa1469d","year":2023},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.027534Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:81896099211181ece3daad396b8b9747f9083fd5cf0f46a48f2a0904011354f5","observation_id":"e505fc9e-b0e3-4767-b864-888fdaeacf05","resolution":{"observed_at":"2026-08-10T20:54:43.174794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.153592Z","title":"Parameter-efficient orthogonal finetuning via butterfly factorization","venue":null,"work_id":"70565017-0e90-4f9b-80ff-64cc03ecf717","year":2024},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.036148Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:3472307b8edc38c3549282b6726ff94dbb6d44a2c20b605cc873aa395a142f09","observation_id":"28e3861d-9b5e-47a4-8b7d-ab648063990a","resolution":{"observed_at":"2026-08-10T20:54:43.159533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.137809Z","title":"Rota- tion equivariant cnns for digital pathology","venue":null,"work_id":"5373b42b-522f-4319-92e6-678012c8dfb5","year":2018},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.044553Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:12d202f8b992bec7155f408b06d28ce54674dabff5f9e53dace3d475c4a32114","observation_id":"a93ac864-5626-4186-b822-1bdcd7a1331b","resolution":{"observed_at":"2026-08-10T20:54:43.142968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:43.122852Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":"3753bbcf-e2b7-4514-9dce-e584adf62bfe","year":2019},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.053397Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:7aa15e686ee6e6dafa033ae7aad1f649b52e15769554c9deba4ea0f530c0e6a4","observation_id":"1213e20d-3c1f-44db-8899-84c2a762218b","resolution":{"observed_at":"2026-08-10T20:54:43.128472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:42.059676Z","title":"Remote sensing image scene classification: Benchmark and state of the art","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.059676Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:91402c512d7fa772a665cabeb55ef14eae3e478af214d256af3a1610f6cd297d","observation_id":"d86c7d48-1876-43c3-bfa6-2f0204a79627","resolution":{"observed_at":"2026-08-10T20:54:42.059676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:54:42.066284Z","title":"Kaggle diabetic retinopathy detection, July 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:42.066284Z"},"links":{"citing_paper":"/paper/2501.06884"},"observation_digest":"sha256:d507fdb4743e257e1c6432ac860676f092c7f0888af3029a19a9ce0365e19471","observation_id":"c085bf5f-09e2-448c-a18b-59c47b12818e","resolution":{"observed_at":"2026-08-10T20:54:42.066284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.06884","last_updated":"2025-01-12T17:41:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T20:47:32.579766Z","submitted_at":"2025-01-12T17:41:23Z","title":"Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":119},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 119 outbound references and 0 inbound Pith citation observations for arXiv:2501.06884."}