{"as_of":"2026-08-04T19:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6691b6405c0bd44170ce96c8522314840f28d76e5157be8c529deecc362d542a","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:42:48.902337Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T06:49:17.291168Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T14:58:32.924904Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"cited_work":{"arxiv_id":"2604.08939","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.08939","snapshot_observed_at":"2026-07-03T14:58:32.924904Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","venue":"cs.LG","work_id":"67ba26a7-044d-4b9e-9818-cdcfb8957a6e","year":2026},"citing_paper":{"arxiv_id":"2606.13258","last_updated":"2026-06-16T06:38:50Z","snapshot_observed_at":"2026-08-02T18:32:05.378717Z","submitted_at":"2026-06-11T12:15:29Z","title":"MOSAIC: Modality-Specific Adaptation for Incremental Continual Learning in Parkinson's Disease Gait Assessment","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T06:49:17.291168Z"},"links":{"cited_paper":"/paper/2604.08939","citing_paper":"/paper/2606.13258"},"observation_digest":"sha256:350698ffd36b18a2f91e170a9e6db17dbdb5279dbcc75e5a4e03ba61a7850d45","observation_id":"cfede806-70e8-4a33-b8f8-70e0903d1fda","resolution":{"observed_at":"2026-07-03T14:58:32.926048Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.08939/citation-record","integrity":"/paper/2604.08939/integrity","json":"/paper/2604.08939/citation-record.json","paper":"/paper/2604.08939"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Just pick a sign: Optimizing deep multitask models with gradient sign dropout.Advances in Neural Information Processing Systems, 33:2039–2050","venue":null,"work_id":"91a348ad-6a5b-4b47-9f06-a2319e3c1c87","year":2039},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:eb6a2857ffda80ab98fa7da5858ac39447438beb11e942134de349ab534204f3","observation_id":"fc0d6e15-4f14-493e-89e1-9845f8ba3927","resolution":{"observed_at":"2026-05-17T13:59:43.849924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:f34ad0cec256426407d18a60282c033b04cb92dfa2028a4ab466833880e65412","observation_id":"f7355736-3337-41ad-a903-824435e96b14","resolution":{"observed_at":"2026-05-11T08:20:59.047032Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.10603","last_updated":"2022-07-27T15:44:33Z","snapshot_observed_at":"2026-08-04T09:16:41.802622Z","submitted_at":"2021-11-20T14:28:32Z","title":"Reasonable Effectiveness of Random Weighting: A Litmus Test for Multi-Task Learning","version":2},"cited_work":{"arxiv_id":"2111.10603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2111.10603","snapshot_observed_at":"2026-07-02T18:37:15.940790Z","title":"Reasonable effectiveness of random weighting: A litmus test for multi-task learning.arXiv preprint arXiv:2111.10603","venue":null,"work_id":"0729e4fd-6cb2-42f6-80fd-132591645d02","year":2022},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/2111.10603","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:7bed3addd0dc43548d3694f11e65182fed184c53eea168b3bb04b5aebbdb81e7","observation_id":"ee2a7dcc-610b-42d3-a27d-23060c3d36c5","resolution":{"observed_at":"2026-05-11T08:20:59.026124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.03265","last_updated":"2021-10-26T02:48:30Z","snapshot_observed_at":"2026-07-06T08:13:17.750215Z","submitted_at":"2019-08-08T20:51:17Z","title":"On the Variance of the Adaptive Learning Rate and Beyond","version":4},"cited_work":{"arxiv_id":"1908.03265","doi":"10.48550/arxiv.1908.03265","metadata_source":"arxiv_reference","pith_arxiv_id":"1908.03265","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"On the variance of the adaptive learning rate and beyond.arXiv preprint arXiv:1908.03265","venue":null,"work_id":"7acbf612-b1e2-43af-bfe5-3a9d75e45cb6","year":1908},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/1908.03265","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:d95c2308ba04a6ba552a27d7a6cacab558a2c238c3aee929099247aa7ce9e99b","observation_id":"e23ddd4e-e4dc-4372-856d-6bf8144e9d3e","resolution":{"observed_at":"2026-05-11T08:20:59.066359Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-03T18:08:20.655659+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T18:08:20.655659+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:86bb886306f28fd63da4b7ece5b33086a373370ec93c2e2445625fa38a69139c","observation_id":"e0540a3f-e8c2-45ab-b36d-b1c587fc73b6","resolution":{"observed_at":"2026-05-11T08:20:59.071095Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09843","last_updated":"2019-02-26T10:22:48Z","snapshot_observed_at":"2026-07-06T07:35:29.946706Z","submitted_at":"2019-02-26T10:22:48Z","title":"Adaptive Gradient Methods with Dynamic Bound of Learning Rate","version":1},"cited_work":{"arxiv_id":"1902.09843","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09843","snapshot_observed_at":"2026-06-30T18:35:00.423360Z","title":"Adaptive Gradient Methods with Dynamic Bound of Learning Rate","venue":"cs.LG","work_id":"3340d7e4-34a9-4550-975b-fd9f076e1a1a","year":2019},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/1902.09843","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:286de3c81698130ed6ff72a87d371a27589596145501daaca9d03540394d436b","observation_id":"c0534f89-f042-4bd8-84f6-94ed90acec3f","resolution":{"observed_at":"2026-05-11T08:20:59.042729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.01017","last_updated":"2022-07-08T12:00:51Z","snapshot_observed_at":"2026-08-03T15:35:05.073940Z","submitted_at":"2022-02-02T13:21:53Z","title":"Multi-Task Learning as a Bargaining Game","version":2},"cited_work":{"arxiv_id":"2202.01017","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2202.01017","snapshot_observed_at":"2026-07-04T13:49:51.448499Z","title":"Multi-task learning as a bargaining game","venue":null,"work_id":"d87fe5a4-72fa-49a7-884b-b7ef5d576496","year":2022},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/2202.01017","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:52646296543ae86647e03074452d0bebe43e1c528ccb724e990123558dbcc7b0","observation_id":"6829bdf3-132d-4900-b8fd-8c072007da90","resolution":{"observed_at":"2026-05-11T08:20:59.030964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16232","last_updated":"2025-02-03T12:29:44Z","snapshot_observed_at":"2026-07-06T18:35:45.699877Z","submitted_at":"2024-06-23T22:06:25Z","title":"Jacobian Descent for Multi-Objective Optimization","version":3},"cited_work":{"arxiv_id":"2406.16232","doi":"10.48550/arxiv.2406.16232","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16232","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Jacobian descent for multi-objective optimization.arXiv preprint arXiv:2406.16232","venue":null,"work_id":"4711764f-d344-4191-acbd-4f2e75a07b53","year":2024},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/2406.16232","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:ad779b73181055977d0c2bada075329d55ace3bd604ca669b7d22814d78ad5d3","observation_id":"3a38b7b6-953e-486e-a4c4-04b4f2aa534a","resolution":{"observed_at":"2026-05-11T08:20:59.057508Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09237","last_updated":"2019-04-19T16:21:38Z","snapshot_observed_at":"2026-08-03T03:50:23.110540Z","submitted_at":"2019-04-19T16:21:38Z","title":"On the Convergence of Adam and Beyond","version":1},"cited_work":{"arxiv_id":"1904.09237","doi":"10.1016/s0893-6080(98","metadata_source":"pith","pith_arxiv_id":"1904.09237","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"On the Convergence of Adam and Beyond","venue":"cs.LG","work_id":"c727f303-212d-4d55-8c2c-19128e3c9c3f","year":2019},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/1904.09237","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:9a7b86ae6a68c7ad72d7f18211e5f93cb9b195833c7260401cd169ba80f2cc0c","observation_id":"41029645-f60b-4563-92d6-a266763e3481","resolution":{"observed_at":"2026-05-11T08:20:59.086042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"17997491-3995-46e2-ba6c-36422d72f4cd","year":2012},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:3ca08ae9b1c096795a8f9088afed4f68245879e71233cdfd67cd5b7a3a451151","observation_id":"b65c4361-6a51-44ff-b669-fd0546f3b824","resolution":{"observed_at":"2026-05-17T13:59:43.853041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.08585","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ldc-mtl: Balancing multi-task learning through scalable loss discrepancy control.arXiv preprint arXiv:2502.08585","venue":null,"work_id":"55c7c05a-816c-4c3a-b02a-eec46ff8a7e9","year":2025},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:69236392d2d23ca8e01f5a12c005fed812e9d8769fbba541c8fb941aec914f01","observation_id":"c44f8ea3-2c30-413d-bad2-5e89a707d57f","resolution":{"observed_at":"2026-05-11T08:20:59.062078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20008","last_updated":"2024-10-25T23:38:28Z","snapshot_observed_at":"2026-07-06T19:40:04.428123Z","submitted_at":"2024-10-25T23:38:28Z","title":"Layer by Layer: Uncovering Where Multi-Task Learning Happens in Instruction-Tuned Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.20008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20008","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Layer by layer: Uncovering where multi-task learning happens in instruction-tuned large language models.arXiv preprint arXiv:2410.20008","venue":null,"work_id":"f655fad4-0200-4649-b649-41ded0c117d4","year":null},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/2410.20008","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:059cec629c556bdffa295a54d67c207b4d5b980b702478dd159986047c868f94","observation_id":"20b205b3-0cf3-4095-9cdb-131e372c47d7","resolution":{"observed_at":"2026-05-11T08:20:59.036510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08006","last_updated":"2025-03-11T03:11:54Z","snapshot_observed_at":"2026-07-06T20:50:23.458400Z","submitted_at":"2025-03-11T03:11:54Z","title":"Injecting Imbalance Sensitivity for Multi-Task Learning","version":1},"cited_work":{"arxiv_id":"2503.08006","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08006","snapshot_observed_at":"2026-07-03T14:58:32.924225Z","title":"Injecting imbalance sensitivity for multi-task learning.arXiv preprint arXiv:2503.08006, 2025a","venue":null,"work_id":"93320e6e-2b96-4456-8344-50f6a860ea84","year":2025},"citing_paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T16:42:48.902337Z"},"links":{"cited_paper":"/paper/2503.08006","citing_paper":"/paper/2604.08939"},"observation_digest":"sha256:ca6f3e39a3d7b763765d1aa14fbcf00a061b04613fbb6dc4d12765cd251101ce","observation_id":"8c63d910-e1ed-47f6-b052-9cadfdcc4e81","resolution":{"observed_at":"2026-05-11T08:20:59.010613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.08939","last_updated":"2026-04-10T04:15:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-31T21:01:00.326573Z","submitted_at":"2026-04-10T04:15:31Z","title":"Delve into the Applicability of Advanced Optimizers for Multi-Task Learning"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":10,"verified_fuzzy":2},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 1 inbound Pith citation observation for arXiv:2604.08939."}