{"as_of":"2026-08-07T18:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ee5c24c836bc94f4564174b0261edaf6308463caebd925e4102d25f088ba721","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:48:38.958431Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07485/citation-record","integrity":"/paper/2507.07485/integrity","json":"/paper/2507.07485/citation-record.json","paper":"/paper/2507.07485"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:50.749880Z","title":"Mult: an end-to-end multitask learning transformer","venue":null,"work_id":"d1f01e62-db3d-4ad5-ba4f-b7995c098bc0","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.674604Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:f3807876bb0f3fea0d2b0bf44529e2bdc6d67e07a23aa5c0a453a7f39ffe5c12","observation_id":"fecf09e9-5969-4f7e-bf2d-d734db82bb85","resolution":{"observed_at":"2026-08-06T18:48:50.861375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:50.485725Z","title":"Stochastic filter groups for multi-task cnns: Learning specialist and gener- alist convolution kernels","venue":null,"work_id":"7d0fa78f-4af6-42a4-b369-96c019478330","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.824263Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e6184cec4badf557bb66a212c0046cbad59c1e4bd941465a91d5e7b38e8baa3f","observation_id":"4ce171c5-55b1-489f-bf0b-93d6a1fe8326","resolution":{"observed_at":"2026-08-06T18:48:50.615095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.10292","last_updated":"2021-05-11T17:58:18Z","snapshot_observed_at":"2026-08-01T10:22:15.291477Z","submitted_at":"2020-08-24T09:49:19Z","title":"Automated Search for Resource-Efficient Branched Multi-Task Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.10292","snapshot_observed_at":"2026-08-06T18:48:30.167420Z","title":"Automated search for resource- efficient branched multi-task networks","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.167420Z"},"links":{"cited_paper":"/paper/2008.10292","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:5988b2434dd60820aec109e4eeab681de01ef93386fe271fed05377a0162605e","observation_id":"781e05b3-2753-423b-bf3d-c812e0ef5d9f","resolution":{"observed_at":"2026-08-06T18:48:30.167420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:50.234381Z","title":"Multi-task learning for multi-objective evolutionary neural architecture search","venue":null,"work_id":"68b939e8-f32d-4b7c-b5ff-1099997579f0","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.395849Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:b3659c227b063ec4b3c283a27851e31835cf54462ea0b40c06e26ba5d98718fd","observation_id":"062bc205-5f6a-4c00-b9ae-4bc6f3972921","resolution":{"observed_at":"2026-08-06T18:48:50.358067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:49.936724Z","title":"Multitask learning","venue":null,"work_id":"dbbd5ba4-dfee-4256-92bc-8192c0bb10f1","year":1997},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.559093Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:d64d9ab086ec5a068a7fcaf21fcd0a2e09f218767fe9ba330994974389e1016a","observation_id":"c814037d-3c1d-4800-a4c5-c637e019db2c","resolution":{"observed_at":"2026-08-06T18:48:50.090105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:49.688165Z","title":"Gradnorm: Gradient normalization for adaptive loss balancing in deep multitask networks","venue":null,"work_id":"6df46c2b-5188-4081-9d83-ccce91772acf","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.763211Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:5aca7729da79bae9a114db2b3fedaf1a82867df28cdc1e525ea52ab12cf33182","observation_id":"f7629f9a-a29d-47bc-9f21-6d7e35c753dc","resolution":{"observed_at":"2026-08-06T18:48:49.775173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:49.472989Z","title":"Just pick a sign: Optimizing deep multitask models with gra- dient sign dropout","venue":null,"work_id":"70a456e5-28b8-4e3a-8000-eff6dd038e34","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.921696Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:45c178b3c00ffec3fd8c826a529f8d3067bbf029aafb2c71d903ba4dc2dc268f","observation_id":"f251ddd1-8f31-4d54-8287-db81035d507b","resolution":{"observed_at":"2026-08-06T18:48:49.575397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:49.206164Z","title":"Mod-squad: Designing mixtures of experts as modular multi-task learners","venue":null,"work_id":"f6b4a539-2866-404e-a28a-3a28d86f68a4","year":2023},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.143715Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:c77c71d2f618d377833cd7e200979c31a1a079dd8a676efb665d566ee35d285b","observation_id":"271a6ac8-cfd8-43a5-b202-a1900ac92752","resolution":{"observed_at":"2026-08-06T18:48:49.321291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09796","last_updated":"2020-09-10T19:31:04Z","snapshot_observed_at":"2026-07-06T09:57:23.086479Z","submitted_at":"2020-09-10T19:31:04Z","title":"Multi-Task Learning with Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09796","snapshot_observed_at":"2026-08-06T18:48:31.272266Z","title":"Multi-task learning with deep neural networks: A survey","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.272266Z"},"links":{"cited_paper":"/paper/2009.09796","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:50d549207549b59f806209c4856e1993daa5b8fa85acbc8ce3c8c7bae2a9f50b","observation_id":"80058b8f-1dba-4fa1-a457-33252f403a32","resolution":{"observed_at":"2026-08-06T18:48:31.272266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:48.946683Z","title":"Instance-aware se- mantic segmentation via multi-task network cascades","venue":null,"work_id":"8e38afb2-7f52-4a01-95e5-401d417cff8b","year":2016},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.426283Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:113bb915b5fa385e0681d9f8ddf02cfdd91c2173718898b9ad30a8fd65691741","observation_id":"e312c736-64f7-4f70-bcbb-99c8b1739038","resolution":{"observed_at":"2026-08-06T18:48:49.073544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:48.646346Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"97495d23-40bc-403a-bd54-b6b201c23532","year":2009},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.569245Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:f71a7e68660a39665be97995e9fa94e3a960a9ec2d23cfb5b9cd5043eb3a3fd1","observation_id":"78f7444d-0501-47ae-83fc-361f8ff61f02","resolution":{"observed_at":"2026-08-06T18:48:48.777014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:48.412515Z","title":"Multiple-gradient descent algorithm (mgda) for multiobjective optimization","venue":null,"work_id":"f0077a96-6dc4-4edd-8625-7b766dc4e6e3","year":2012},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.734799Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:19e7110c9495662412eeb0aeb7ff5c375bf759fe75febed06b910a842bc6976d","observation_id":"c1ba4ce6-f68f-40a8-ae16-0dcc16fcecff","resolution":{"observed_at":"2026-08-06T18:48:48.515634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T18:48:31.876135Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.876135Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:864c0df24b781ab0139df95da1aa3fd0aa468ca4f10e149e8e3f33cc721f1951","observation_id":"8aa0341d-b011-49e0-ac54-d62edcb87143","resolution":{"observed_at":"2026-08-06T18:48:31.876135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:48.098354Z","title":"Representation similar- ity analysis for efficient task taxonomy & transfer learning","venue":null,"work_id":"ff3b5874-443d-4bfd-a336-14c0b12f022a","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.009274Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:9ea516c9c5e381308ae8a072712858590d1f72bf71f4ca27a1d57714e0cacb78","observation_id":"8e5222a8-b794-4e34-af9e-b3e5612ae5da","resolution":{"observed_at":"2026-08-06T18:48:48.247012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:32.150261Z","title":"Predicting depth, surface nor- mals and semantic labels with a common multi-scale con- volutional architecture","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.150261Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:716cda145d94814d65e09cb9337adfd0caa4693454f3f1e7eaa9cf23691cfe2b","observation_id":"21c91871-9fb6-497d-9cd5-11db67abaa2a","resolution":{"observed_at":"2026-08-06T18:48:32.150261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:47.836118Z","title":"The pascal visual object classes challenge 2012 (voc2012) development kit","venue":null,"work_id":"0b5347ff-f96c-4d1b-baf4-2f4dfd28c5f7","year":2012},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.351733Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:f3cc5eb760f7ea74d64a84b6b5665eeb62745e0b54833463da6a442b38a94553","observation_id":"1bb1cfdc-f3be-48fc-9250-cbe574e0f54f","resolution":{"observed_at":"2026-08-06T18:48:47.918033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:32.524698Z","title":"M 3vit: Mixture-of-experts vision transformer for efficient multi- task learning with model-accelerator co-design","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.524698Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:0e01cfc570d5e90a1776518591c2436c3a35bdd2d4894c1f3dbf0724a92b74b6","observation_id":"3ae8bae1-0345-4983-8602-646612e55f58","resolution":{"observed_at":"2026-08-06T18:48:32.524698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.08734","last_updated":"2017-01-30T18:06:07Z","snapshot_observed_at":"2026-07-06T05:28:04.756968Z","submitted_at":"2017-01-30T18:06:07Z","title":"PathNet: Evolution Channels Gradient Descent in Super Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.08734","snapshot_observed_at":"2026-08-06T18:48:32.677340Z","title":"Pathnet: Evolution channels gradient descent in super neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.677340Z"},"links":{"cited_paper":"/paper/1701.08734","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:dd4cc103c76aa84a145b94562ae0bc9dad03afc1fd0d8eade0f1c5aae5a58391","observation_id":"aa8e72a3-5413-4bd5-8498-4538cbde0eed","resolution":{"observed_at":"2026-08-06T18:48:32.677340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:47.609408Z","title":"Nddr-cnn: Layerwise feature fusing in multi-task cnns by neural discriminative dimensionality reduction","venue":null,"work_id":"1de74a91-ee04-4d5b-843c-8d096c9a06b3","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.808495Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:2d436d64a5e82eac2dbf914c2bc08e3c5e9a022122f567c2829ce397fe207b95","observation_id":"55ffe5c8-fd40-40a0-9fe0-f630d4d7a200","resolution":{"observed_at":"2026-08-06T18:48:47.738040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:47.316897Z","title":"Mtl-nas: Task-agnostic neural architecture search towards general-purpose multi-task learning","venue":null,"work_id":"928df65f-87c1-45a2-9eef-7c1cb60ea540","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.957285Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:857a858d211ad646a80c4be5e3a4dc70814d16547443589d6fca77aa0fde1ee3","observation_id":"328cc590-f052-4edb-aded-2558016eca5a","resolution":{"observed_at":"2026-08-06T18:48:47.478632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:47.139230Z","title":"Recon: Reducing conflicting gradients from the root for multi-task learning","venue":null,"work_id":"e1086d58-4216-4fd4-9095-418157b803ef","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.108298Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:24f8343e55d8ed357a1e0a1417ea05f1e8154eccbe6de9287726708bfd24e640","observation_id":"6390a255-898d-405f-b071-1f50578df0a2","resolution":{"observed_at":"2026-08-06T18:48:47.201119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:33.250866Z","title":"Dynamic task prioritization for multitask learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.250866Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:87035129b0b34100a4fc44c03547e10d747754ad3791466b2f7cb7f0a8555c53","observation_id":"31949ec6-e944-4300-9505-72631582833f","resolution":{"observed_at":"2026-08-06T18:48:33.250866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.869179Z","title":"Learn- ing to branch for multi-task learning","venue":null,"work_id":"5c595cf1-0e1c-4fe2-8f90-6fb07a271b32","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.462644Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:16cf4ec71fb697b02f17dfaf5bc787ada20df7df37b942228d49128fe3ec16d3","observation_id":"5b586913-eb12-47a9-98e7-bfbd92dfb6e4","resolution":{"observed_at":"2026-08-06T18:48:47.015886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.772341Z","title":"Learn- ing to branch for multi-task learning","venue":null,"work_id":"f2d1a59f-89d3-4059-ae83-d5eda1063335","year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.656219Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:246c8a399dfe526ef5b827535454d0df70651ea585b3474a5a1fba870049738e","observation_id":"7007754f-2ec5-4cb3-abae-d9597b560b02","resolution":{"observed_at":"2026-08-06T18:48:46.811512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.676893Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"9de867c5-7398-4084-ae60-c25fefbefe47","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.795485Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:627f8f3159e6be870b30d2bf044a7f776444f0a35e1a8dcaa3e3b299cf1baad5","observation_id":"41e9c13c-fd13-4b41-9188-f3e6db761062","resolution":{"observed_at":"2026-08-06T18:48:46.713260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.498477Z","title":"Going beyond multi-task dense prediction with synergy em- bedding models","venue":null,"work_id":"d80822a3-9793-4469-8bb4-570805ba13be","year":2024},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.916832Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:36b0e3b64d475d948a997fb13eae08b042ec4b5a526efc5216620c3e654929ed","observation_id":"40b64a45-bd0e-4aff-be0c-db1c058ef4cd","resolution":{"observed_at":"2026-08-06T18:48:46.613906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02631","last_updated":"2022-02-16T11:20:05Z","snapshot_observed_at":"2026-08-04T23:18:25.167100Z","submitted_at":"2021-03-03T19:03:52Z","title":"RotoGrad: Gradient Homogenization in Multitask Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.02631","snapshot_observed_at":"2026-08-06T18:48:34.097023Z","title":"Rotograd: Gradi- ent homogenization in multitask learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.097023Z"},"links":{"cited_paper":"/paper/2103.02631","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:5d326ab70ca7d900f5114b7c37472196ff5846e8b259e0c1667f753d1cf9bf13","observation_id":"ada1e55c-6c7a-40ed-b5c7-a0907fbbcf0b","resolution":{"observed_at":"2026-08-06T18:48:34.097023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.317913Z","title":"Quantifying task pri- ority for multi-task optimization","venue":null,"work_id":"429a7e18-2647-4bf0-894b-5ab0a5b20135","year":2024},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.224503Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:87301931dd329091ea856a138428e777fda1a1131febef609d18b4824fe641fb","observation_id":"502fb8a2-ebe6-40e6-800c-033f6bd6f215","resolution":{"observed_at":"2026-08-06T18:48:46.375068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11986","last_updated":"2025-04-22T15:24:22Z","snapshot_observed_at":"2026-08-07T18:12:40.637599Z","submitted_at":"2025-02-17T16:26:05Z","title":"Selective Task Group Updates for Multi-Task Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11986","snapshot_observed_at":"2026-08-06T18:48:34.286201Z","title":"Selective task group updates for multi-task optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.286201Z"},"links":{"cited_paper":"/paper/2502.11986","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:160e187d6f5702a2c1998f59e6da912f29959d5dd01bbe088cc1acf2086aee90","observation_id":"92a15a07-2a8a-4bc7-beb6-36fa4161daaa","resolution":{"observed_at":"2026-08-06T18:48:34.286201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:46.057727Z","title":"Forkmerge: Mitigating negative transfer in auxiliary-task learning","venue":null,"work_id":"afb988de-c6b0-46d2-a9e9-2c3d25c5329a","year":2024},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.405324Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:f016ef85491ceb1191af227108ff8e55d42a5adb4e4e4ad67a04da10de080851","observation_id":"e0749efc-7a4a-4f3c-86f2-1493cab64f1b","resolution":{"observed_at":"2026-08-06T18:48:46.206402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:45.905799Z","title":"Principal component anal- ysis: A review and recent developments","venue":null,"work_id":"f71a1054-b623-49ff-a869-e8ea4e7a301d","year":2016},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.586586Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:3d550ef42c127307b02b56f10057917d1f26074f665bed2b435ec05b5aa61317","observation_id":"24d4da77-9638-4616-a28a-7fd7021f617d","resolution":{"observed_at":"2026-08-06T18:48:45.957099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:34.688994Z","title":"Multi-task learning using uncertainty to weigh losses for scene geome- try and semantics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.688994Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e1cbca15e661ca890304d91f7921521b92533ed8d558b63a509a2e5fb33653c7","observation_id":"43b4b6af-e5b9-423f-873c-0b4a6334ed34","resolution":{"observed_at":"2026-08-06T18:48:34.688994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:45.634081Z","title":"Evo- lutionary architecture search for deep multitask networks","venue":null,"work_id":"34b72e44-c1ab-437f-935a-bd12a0c90c9c","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.780014Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:1b79efc2040dd8fbc07cfe486e450bb45bf1687c9a64d4519c4baa5287e32149","observation_id":"7020b02c-f09a-44f4-bfc0-4b65d0e4a87f","resolution":{"observed_at":"2026-08-06T18:48:45.775092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:45.382699Z","title":"Conflict-averse gradient descent for multi-task learn- ing","venue":null,"work_id":"b9ce703e-c5c1-4e9e-affb-e3a332459c94","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.879410Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:554811665a80df4169d56ddbdfaf4a37db7e855f9f481103ca705a87d5ea8939","observation_id":"4a0c7629-4be0-4e65-976b-52b455fe8688","resolution":{"observed_at":"2026-08-06T18:48:45.481085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:45.192815Z","title":"Famo: Fast adaptive multitask optimization","venue":null,"work_id":"fdfb7305-f077-411b-9e60-03ec9542d819","year":2024},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:34.962590Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:525ff9dc3dec120766148e3dc87ff1524cf70b4b59ebb38491360ea0af0bb3a0","observation_id":"8fd9ff9e-ca99-4f1a-835f-60ba30fa728c","resolution":{"observed_at":"2026-08-06T18:48:45.270545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.923727Z","title":"Towards impartial multi-task learning","venue":null,"work_id":"418392d8-ca57-4c22-b1a1-9bb95a109350","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.060933Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:7325621b9d82260e98a7b4f0635f80c1c87ed36e8a59371edfe406bcc1eb75da","observation_id":"fb01b006-a983-4f5c-a8a7-83bb4a82f424","resolution":{"observed_at":"2026-08-06T18:48:45.067762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.648144Z","title":"End- to-end multi-task learning with attention","venue":null,"work_id":"029a1106-795b-447f-bf0d-9b857e9e5f1b","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.182541Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:419e3773d397827335bcee0f8e5a70bb03167501efb6733891526fa72bc16880","observation_id":"01be7dfd-985a-44f4-ae07-7a4c96f7b208","resolution":{"observed_at":"2026-08-06T18:48:44.762597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.287041Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.287041Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e756cf532298f2c1efb4e3cc627d0a5a34b9b9b12524b5e4682a29c609d6d210","observation_id":"d57134b6-bd90-4ef0-b56f-a2e30141bdb3","resolution":{"observed_at":"2026-08-06T18:48:35.287041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.513425Z","title":"Fully-adaptive feature shar- ing in multi-task networks with applications in person at- tribute classification","venue":null,"work_id":"2267c1fe-3b4e-44a4-88cd-ccb6fb159f1f","year":2017},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.355872Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:de321b811af925166467f60e9e17160a1a315cadc3d7dd4da09e3d108eb427a9","observation_id":"a65ed0cb-76dc-42ac-aae5-0a0315da0c76","resolution":{"observed_at":"2026-08-06T18:48:44.563854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.441034Z","title":"Modeling task relationships in multi-task learning with multi-gate mixture-of-experts","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.441034Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:6777f2209919c62855832b1ea16c7a52d28df16d016723d98a1ad4857ec87343","observation_id":"a34c10d1-8c33-4033-a004-39822818204e","resolution":{"observed_at":"2026-08-06T18:48:35.441034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.361900Z","title":"Attentive single-tasking of multiple tasks","venue":null,"work_id":"d723f910-3f6b-4928-82ec-3f0ce9d234d3","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.523440Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e96fecdfe1161da42d0ce56aba6f276be52c856fc045251da732f24c63a37d14","observation_id":"98fbd9d7-b3e9-4909-adc3-55f9b66a5176","resolution":{"observed_at":"2026-08-06T18:48:44.439519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.607735Z","title":"The role of context for object detection and semantic segmentation in the wild","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.607735Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:b31394f967822bbecde1af3f1ddc34f69127400a69649e6fd617eaa6cb2e783c","observation_id":"a787a70f-02d7-436c-879d-f3080c931f82","resolution":{"observed_at":"2026-08-06T18:48:35.607735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:44.139266Z","title":"Multimodal contrastive learn- ing with limoe: the language-image mixture of experts","venue":null,"work_id":"aacbbd2a-5259-4aef-8f06-badbb289316d","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.673934Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:797c142bf31132d70eab5c7d64d90022a08107fd14a04a6def01db7b0fb99110","observation_id":"6f9977dd-c985-4a50-9c98-ca0b78ac5fda","resolution":{"observed_at":"2026-08-06T18:48:44.237370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.01017","last_updated":"2022-07-08T12:00:51Z","snapshot_observed_at":"2026-08-03T15:35:05.073940Z","submitted_at":"2022-02-02T13:21:53Z","title":"Multi-Task Learning as a Bargaining Game","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.01017","snapshot_observed_at":"2026-08-06T18:48:35.755632Z","title":"Multi- task learning as a bargaining game","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.755632Z"},"links":{"cited_paper":"/paper/2202.01017","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:cae1d5fe1245e668fcbcb537b78b3e29864922fe85688d8a047528ed3b728cc6","observation_id":"5c2ef916-3732-4d8a-8444-c2fe7656f3e6","resolution":{"observed_at":"2026-08-06T18:48:35.755632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:43.898406Z","title":"What is being transferred in transfer learning? Advances in neural information processing systems , 33:512–523, 2020","venue":null,"work_id":"8f7df5a2-83e1-44f9-a8e4-298039c87add","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.848027Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:057491d7b546fe0a588890a7ab000047038092adc7da959d7f2ee034c032dfe8","observation_id":"6dd9ca90-b607-43e8-8346-9b6f91d8f335","resolution":{"observed_at":"2026-08-06T18:48:44.014755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05226","last_updated":"2019-06-12T16:01:35Z","snapshot_observed_at":"2026-07-06T07:59:51.589340Z","submitted_at":"2019-06-12T16:01:35Z","title":"Continual and Multi-Task Architecture Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05226","snapshot_observed_at":"2026-08-06T18:48:35.937987Z","title":"Continual and multi-task architecture search","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:35.937987Z"},"links":{"cited_paper":"/paper/1906.05226","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:2f2ea7c43ff43987ef7816095c301d8dac9db3212a68408dca4fcab338c28e76","observation_id":"cd0f000a-516a-4889-b533-445f8385c292","resolution":{"observed_at":"2026-08-06T18:48:35.937987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:43.663290Z","title":"Scaling vision with sparse mix- ture of experts","venue":null,"work_id":"65af57fd-0cf0-4501-a6d8-355d6c5fba92","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.090614Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:ebebbc03767446bf2a01887ccac80069dd5ab5733b6031ead3b7cd97d2bb9907","observation_id":"da61be4d-5d47-4736-a2fc-5eb3ae4fd660","resolution":{"observed_at":"2026-08-06T18:48:43.721845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:43.358693Z","title":"Multi-task learning as multi-objective optimization","venue":null,"work_id":"6b83d321-f05e-4bdc-b613-5b744b69792b","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.181436Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:f864745719498516f7b708567ff84c7002a5b04da5276b3203a11a29b03065e6","observation_id":"3fd05bf1-56f6-4acd-80ad-3727789be5da","resolution":{"observed_at":"2026-08-06T18:48:43.529171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:43.085538Z","title":"Independent component alignment for multi-task learning","venue":null,"work_id":"ee27f77a-97db-4044-9c77-5b17cb4cd1f3","year":2023},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.329380Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:1e2a244ad32f6280be3acd8061ea89d63fe44a081568dc077aaa21b0e99ae123","observation_id":"9a674533-8282-43d5-9997-5d25bd8048b6","resolution":{"observed_at":"2026-08-06T18:48:43.215508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.900387Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"52ddee6e-c977-44ed-a51f-fd0d2e205116","year":2012},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.444238Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:933adf0d8cfa8662df838a23512e700791e1805a7bebccbb6f1f43db4ca06ad6","observation_id":"9c8a074e-d57f-4d34-8396-c17399a594c8","resolution":{"observed_at":"2026-08-06T18:48:42.959890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.713883Z","title":"One-shot neural architecture search for deep multi-task learning in computer vision, 2020","venue":null,"work_id":"39809945-ca23-48ff-a35f-fe9a8c10d28b","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.527790Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e9b278a304fa894fefa022b2fc1be43f992d82cd5907479a065b1e514072e4e7","observation_id":"f7bc6950-d762-4f85-b4b1-91c685c38310","resolution":{"observed_at":"2026-08-06T18:48:42.816738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T18:48:36.638196Z","title":"Very deep convo- lutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.638196Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:273633280bea86f16f43c1d6388b357979f757dec7d25298b985d3582b86435c","observation_id":"dd7494ac-ae7d-42e1-b7e7-6cb833c42ac9","resolution":{"observed_at":"2026-08-06T18:48:36.638196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.449910Z","title":"Gradient adversarial training of neural networks","venue":null,"work_id":"22334496-ccf3-4430-9f8e-fe0e731ce614","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.763733Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:b0b5407d5fee24e8a6580ddb01460dc45d7ad796ca9ffdd160166f5afc78e1ab","observation_id":"b2dc4f2a-1093-494d-b60d-e3fbf638ea9f","resolution":{"observed_at":"2026-08-06T18:48:42.551703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.183522Z","title":"Task switching network for multi-task learn- ing","venue":null,"work_id":"d851d610-f823-4b5e-ba7c-dad812369800","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:36.882047Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:6704225e915b77d4d6783a810f960f9e778e2439616f04716e4627ac7c4f46e3","observation_id":"e980d482-c870-425b-b834-4244c732c338","resolution":{"observed_at":"2026-08-06T18:48:42.309014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02920","last_updated":"2020-08-13T06:44:45Z","snapshot_observed_at":"2026-08-06T04:07:36.980294Z","submitted_at":"2019-04-05T08:00:32Z","title":"Branched Multi-Task Networks: Deciding What Layers To Share","version":5},"cited_work":{"arxiv_id":"1904.02920","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.02920","snapshot_observed_at":"2026-08-06T18:48:39.076367Z","title":"Branched Multi-Task Networks: Deciding What Layers To Share","venue":"cs.CV","work_id":"2d5752a0-ede0-4a08-a0b7-110db9e0dedd","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.001910Z"},"links":{"cited_paper":"/paper/1904.02920","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:861b0e1f613754fb716da75b4b0bb09795e3d0b28ef4b1ef4768bb8f8fc84700","observation_id":"67394e19-30d7-41ce-af5c-3f2be19b2c8b","resolution":{"observed_at":"2026-08-06T18:48:39.185135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:42.011685Z","title":"Mti-net: Multi-scale task interaction networks for multi-task learning","venue":null,"work_id":"6f562cbb-2533-40f0-858c-4b850fbc2e39","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.146416Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:9e153acc8ea6ed0be114408dec41d809889f10161ed75f21708a207904122d84","observation_id":"28a406ea-d2d0-4640-8161-f6d115e98168","resolution":{"observed_at":"2026-08-06T18:48:42.068353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.283345Z","title":"Pyramid vision transformer: A versatile backbone for dense prediction without convolutions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.283345Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:49dcf7a4b158873e7627616ae447d8a7a7c73fcd6b1312924e82b09b491508f9","observation_id":"8d16a64b-0a07-453b-a56f-191b8eb8ea8e","resolution":{"observed_at":"2026-08-06T18:48:37.283345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.00154","last_updated":"2021-10-08T06:56:25Z","snapshot_observed_at":"2026-07-06T11:34:22.048470Z","submitted_at":"2021-07-31T05:52:21Z","title":"CrossFormer: A Versatile Vision Transformer Hinging on Cross-scale Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.00154","snapshot_observed_at":"2026-08-06T18:48:37.392730Z","title":"Crossformer: A versatile vision transformer hinging on cross-scale attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.392730Z"},"links":{"cited_paper":"/paper/2108.00154","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:becb990d552b40aff3e4d042e9339707e7ffc3cbfe70a491d755830e92324176","observation_id":"e18ffccc-cc9d-44c7-84aa-1bb21af7bc7b","resolution":{"observed_at":"2026-08-06T18:48:37.392730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:41.699617Z","title":"Segformer: Simple and efficient design for semantic segmentation with transform- ers","venue":null,"work_id":"a13411a7-6673-4901-a8fd-c4d1242168d9","year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.501985Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:3d2001a93018f27b76ec9ce9970df0ca8d6c184fea7292576c4fba50d5569336","observation_id":"913535d4-8906-4dbf-b644-9988673d876c","resolution":{"observed_at":"2026-08-06T18:48:41.838741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:41.537365Z","title":"Pad-net: Multi-tasks guided prediction-and-distillation net- work for simultaneous depth estimation and scene parsing","venue":null,"work_id":"f31817ab-b180-4cea-9984-19f7008cdaa2","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.614147Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:e5d7d9b86155be0f6ddd93fcbee810410b876ab7e73d9fc3fcaa7a0d1c48b6f8","observation_id":"05e3e9f1-943a-4afa-bdeb-a041cdade615","resolution":{"observed_at":"2026-08-06T18:48:41.606439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:41.228111Z","title":"Mtformer: Multi-task learn- ing via transformer and cross-task reasoning","venue":null,"work_id":"bccdae42-fbeb-4efc-9df9-9ac5adf27c49","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.714586Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:cb6a017c0443facab7e43a097c541ef46e208657c44041e96398fe8468389839","observation_id":"f7fcbc18-4270-45a4-a582-d5f2604a1d53","resolution":{"observed_at":"2026-08-06T18:48:41.417387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:41.012040Z","title":"Multi-task learning with multi-query trans- former for dense prediction","venue":null,"work_id":"18e58fd8-6580-47cb-93fa-a2c6ad2a988e","year":2023},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.825793Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:0dc4d9c7200a51e403f75846dcab70f35e5ade86d8a3ebac6b191d8afbbc3e0b","observation_id":"f18c0010-f9fa-47b8-b651-af4f2b875a9b","resolution":{"observed_at":"2026-08-06T18:48:41.135657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:40.723273Z","title":"Demt: De- formable mixer transformer for multi-task learning of dense prediction","venue":null,"work_id":"56f007d3-2316-4296-8a06-da6b3e0ed3c0","year":2023},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:37.918671Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:1999814b14668967baf1926ddf24839c4a296d4550f24364f3c7fa6f6dae339c","observation_id":"7fca0a7a-dc59-4eec-a708-9867c2828fab","resolution":{"observed_at":"2026-08-06T18:48:40.822560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00641","last_updated":"2021-07-01T17:56:09Z","snapshot_observed_at":"2026-08-07T02:29:59.839572Z","submitted_at":"2021-07-01T17:56:09Z","title":"Focal Self-attention for Local-Global Interactions in Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00641","snapshot_observed_at":"2026-08-06T18:48:38.030618Z","title":"Focal self-attention for local-global interactions in vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.030618Z"},"links":{"cited_paper":"/paper/2107.00641","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:bc4e20e5f6673f29d13b699a2e4440a9ca464d82996632ebc2176ab659962982","observation_id":"11e92a37-aad1-48f9-a5f7-6c9e5cae0ffe","resolution":{"observed_at":"2026-08-06T18:48:38.030618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:38.155006Z","title":"Inverted pyramid multi-task trans- former for dense scene understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.155006Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:dac9c285db68b0879a68941174de1319c72139056c3ac11428f737c7dc1e3f79","observation_id":"2e1d4645-e548-49e7-99a9-a46558994a44","resolution":{"observed_at":"2026-08-06T18:48:38.155006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:40.268166Z","title":"Taskprompter: Spatial-channel multi-task prompting for dense scene understanding","venue":null,"work_id":"99ee1d9d-61f2-4177-83be-fb29db3a7f58","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.405272Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:7afc03d90ad350c15b65aa9bd73a9caaaf5014a3f3b350f375bf269a572f4b56","observation_id":"29ee07f6-4be9-4786-a623-fc009c317de8","resolution":{"observed_at":"2026-08-06T18:48:40.354497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:40.118832Z","title":"Gradient surgery for multi-task learning","venue":null,"work_id":"00af5cea-5db8-4785-bd8b-9c1852ecb2cf","year":2020},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.563905Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:22420a87763547b4df9985b2041dfe2e3890bb87420bc848ea1276ff94ee8441","observation_id":"60517d35-9d75-41de-a6ab-3a962973cac4","resolution":{"observed_at":"2026-08-06T18:48:40.183323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:39.857523Z","title":"Taskonomy: Disentangling task transfer learning","venue":null,"work_id":"b1215ccb-7201-4850-8341-663f3b952a7f","year":2018},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.657342Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:63111d1dda03fcf174f1147311576816e859cfcfe0547da8634ba247148a370f","observation_id":"8673fcda-e495-4afb-987a-029f101123e6","resolution":{"observed_at":"2026-08-06T18:48:39.989515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05144","last_updated":"2022-10-11T04:54:05Z","snapshot_observed_at":"2026-07-06T14:03:25.739373Z","submitted_at":"2022-10-11T04:54:05Z","title":"Mixture of Attention Heads: Selecting Attention Heads Per Token","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05144","snapshot_observed_at":"2026-08-06T18:48:38.748604Z","title":"Mixture of attention heads: Selecting attention heads per token","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.748604Z"},"links":{"cited_paper":"/paper/2210.05144","citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:97cc4385da7ce4d8b69c7ea59ed295fa35bfe45aa248b08a18a8f3453851b69f","observation_id":"c0620691-263f-49d0-9227-6f2bacb2b558","resolution":{"observed_at":"2026-08-06T18:48:38.748604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:39.634899Z","title":"Facial landmark detection by deep multi-task learning","venue":null,"work_id":"1acd56c8-2bee-4ea2-a456-c6d009a2d911","year":2014},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.852732Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:adb62d0bf36126d13bd5f82ef13f50833e26d7163927eab67b27e98ca4ea15ab","observation_id":"a70b8529-464f-4dcf-adbd-8a729a2d4d4b","resolution":{"observed_at":"2026-08-06T18:48:39.702232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:39.389465Z","title":"Pattern-affinitive propagation across depth, surface normal and semantic segmentation","venue":null,"work_id":"27b8228f-0286-4d11-97f7-621a86c5fd4c","year":2019},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.958431Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:f06f3ecafa9ce245af39b751b46a097218d7cf47938cacb0bed82fcfcf3d224c","observation_id":"427396f2-410a-43f5-bb85-290f1c047da9","resolution":{"observed_at":"2026-08-06T18:48:39.470318Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:40.454700Z","title":"2, 8, 12","venue":null,"work_id":"af60381f-7caf-4845-b443-64ae10132b79","year":2022},"citing_paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning","version":2},"reference_index":530,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:38.262858Z"},"links":{"citing_paper":"/paper/2507.07485"},"observation_digest":"sha256:4d746ec7c028b0c58ded10f2505577d4871e1d3ed0cbdff89424abdeabeb5313","observation_id":"2fe39442-677e-4ae9-90f2-384e5dd3d5ad","resolution":{"observed_at":"2026-08-06T18:48:40.585241Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07485","last_updated":"2025-07-21T06:05:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T18:37:11.386732Z","submitted_at":"2025-07-10T07:13:22Z","title":"Resolving Token-Space Gradient Conflicts: Token Space Manipulation for Transformer-Based Multi-Task Learning"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":21,"verified_exact":1,"verified_fuzzy":48},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2507.07485."}