{"as_of":"2026-08-09T12:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0bab6174ea7ee21b4046a61c28000232c4d9889c9da8fa6fcc44e2e3e037ad5f","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T20:43:48.614883Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16554/citation-record","integrity":"/paper/2607.16554/integrity","json":"/paper/2607.16554/citation-record.json","paper":"/paper/2607.16554"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2108.05036","last_updated":"2021-08-20T19:39:31Z","snapshot_observed_at":"2026-08-04T04:54:10.587671Z","submitted_at":"2021-08-11T05:15:33Z","title":"DEMix Layers: Disentangling Domains for Modular Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05036","snapshot_observed_at":"2026-08-01T20:43:47.709470Z","title":"Demix layers: Disentan- gling domains for modular language modeling.arXiv preprint arXiv:2108.05036,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:47.709470Z"},"links":{"cited_paper":"/paper/2108.05036","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:ac1e25618a575e4948198f49ad4ced45b44171bc0bbeba3ad7591feddd21b16e","observation_id":"6509145a-8b62-4856-99b3-033735ff69ba","resolution":{"observed_at":"2026-08-01T20:43:47.709470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:43:47.905183Z","title":"doi: 10.18653/v1/2021.acl-long.353","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:47.905183Z"},"links":{"citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:c5dd398762fcd3b2603d75070e1b15f23e4e7ba3cdc20a2e64b65db49a0f3ccb","observation_id":"56bde78b-b3c7-467e-9411-77a44a10cfa3","resolution":{"observed_at":"2026-08-01T20:43:47.905183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.10703","last_updated":"2019-02-24T02:03:00Z","snapshot_observed_at":"2026-07-06T07:10:28.375412Z","submitted_at":"2018-10-25T03:12:37Z","title":"K for the Price of 1: Parameter-efficient Multi-task and Transfer Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.10703","snapshot_observed_at":"2026-08-01T20:43:48.134105Z","title":"Pramod Kaushik Mudrakarta, Mark Sandler, Andrey Zh- moginov, and Andrew Howard","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:48.134105Z"},"links":{"cited_paper":"/paper/1810.10703","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:2164082ea9923d301e92c8bb742e2a73cf047bb82ff33258de4dd89485755cbe","observation_id":"6fa3eb02-427c-4548-882c-000c899c89c5","resolution":{"observed_at":"2026-08-01T20:43:48.134105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00339","last_updated":"2021-03-01T12:12:22Z","snapshot_observed_at":"2026-08-09T09:32:03.753072Z","submitted_at":"2020-07-01T09:06:20Z","title":"Multi-Task Variational Information Bottleneck","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00339","snapshot_observed_at":"2026-08-01T20:43:48.283886Z","title":"Weizhu Qian, Bowei Chen, Yichao Zhang, Guanghui Wen, and Franck Gechter","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:48.283886Z"},"links":{"cited_paper":"/paper/2007.00339","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:cceeea0ce07b55a385347f0a2f210b6afcfb912248554c97989ceaf857e82bd2","observation_id":"c36e4397-703b-4388-be0c-2f017dcb367d","resolution":{"observed_at":"2026-08-01T20:43:48.283886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:43:48.614883Z","title":"Let A∈R T×d stack a⊤ t as rows","venue":null,"work_id":null,"year":2088},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:48.614883Z"},"links":{"citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:963b52086f969b49ce23690ca484249753220ca7daceac28f9fcb47ec91ae64c","observation_id":"721b7ace-62b2-45f6-b32f-b66ae22cdb6b","resolution":{"observed_at":"2026-08-01T20:43:48.614883Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.05808","last_updated":"2020-08-13T10:45:31Z","snapshot_observed_at":"2026-08-08T00:08:47.316086Z","submitted_at":"2020-08-13T10:45:31Z","title":"Small Towers Make Big Differences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.05808","snapshot_observed_at":"2026-08-01T20:43:48.539323Z","title":"Small towers make big differences.arXiv preprint arXiv:2008.05808,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:48.539323Z"},"links":{"cited_paper":"/paper/2008.05808","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:1c0cf2fb87bf45989e00c6bc0e1bb02242de5dd1bb1591f45399047408761784","observation_id":"5021456e-7034-4835-9a20-c5a159aa068e","resolution":{"observed_at":"2026-08-01T20:43:48.539323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04489","last_updated":"2021-06-08T16:16:40Z","snapshot_observed_at":"2026-08-03T19:17:21.128233Z","submitted_at":"2021-06-08T16:16:40Z","title":"Parameter-efficient Multi-task Fine-tuning for Transformers via Shared Hypernetworks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04489","snapshot_observed_at":"2026-08-01T20:43:48.012837Z","title":"Parameter-efficient multi- task fine-tuning for transformers via shared hypernet- works.arXiv preprint arXiv:2106.04489,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:48.012837Z"},"links":{"cited_paper":"/paper/2106.04489","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:b6f87eab71c78c8d62d290d4c4b0eb71ac45b1cb1f8d70f0791453713d042e3b","observation_id":"46268373-9710-4714-860e-83a90a7e91f1","resolution":{"observed_at":"2026-08-01T20:43:48.012837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05098","last_updated":"2017-06-15T21:38:12Z","snapshot_observed_at":"2026-08-04T14:30:44.904839Z","submitted_at":"2017-06-15T21:38:12Z","title":"An Overview of Multi-Task Learning in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05098","snapshot_observed_at":"2026-08-01T20:43:48.391015Z","title":"An overview of multi-task learning in deep neural networks.arXiv preprint arXiv:1706.05098,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:48.391015Z"},"links":{"cited_paper":"/paper/1706.05098","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:c6dafceb6ec559023903d8ed56e12c1664d0ee4072009141b7599e352ce9b6a2","observation_id":"1678fcc3-d794-479a-859e-e980712b268f","resolution":{"observed_at":"2026-08-01T20:43:48.391015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:43:47.574620Z","title":"doi: 10.18653/v1/2020.acl-main.372","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:47.574620Z"},"links":{"citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:65bf08f8995323b3f2f20ad24063c1954defb8b196667977e417b23471f86e46","observation_id":"3fcb24c6-2898-477c-a7e4-4cf5fdc4b9da","resolution":{"observed_at":"2026-08-01T20:43:47.574620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.00410","last_updated":"2019-10-23T22:47:44Z","snapshot_observed_at":"2026-07-06T05:21:01.935928Z","submitted_at":"2016-12-01T20:12:40Z","title":"Deep Variational Information Bottleneck","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.00410","snapshot_observed_at":"2026-08-01T20:43:47.282658Z","title":"doi: 10.18653/v1/2021.acl-long.568","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:47.282658Z"},"links":{"cited_paper":"/paper/1612.00410","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:955d924fa254afe2c4a06b32c0f38604fc1df4b2dc6c6471dbfab80dae937478","observation_id":"0ebb14ca-da17-4d32-aa96-3baa8320a081","resolution":{"observed_at":"2026-08-01T20:43:47.282658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04366","last_updated":"2022-02-02T16:39:23Z","snapshot_observed_at":"2026-08-09T04:45:04.547249Z","submitted_at":"2021-10-08T20:22:26Z","title":"Towards a Unified View of Parameter-Efficient Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04366","snapshot_observed_at":"2026-08-01T20:43:47.807286Z","title":"Towards a unified view of parameter-efficient transfer learning.arXiv preprint arXiv:2110.04366,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:47.807286Z"},"links":{"cited_paper":"/paper/2110.04366","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:6dd47ee7c2d77e3a1bd68692822ba17c1e8a4ace1bc5036b80d379ff71a4a619","observation_id":"4c1c03d2-17b8-4ab4-a286-7a418dd79f5f","resolution":{"observed_at":"2026-08-01T20:43:47.807286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.144","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2023.acl-long.144","venue":null,"work_id":"9cb5d6ba-26cf-4b9a-8000-42961a3dab13","year":2023},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:47.407860Z"},"links":{"citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:779ef954b2172346a4c8ac515a8ffe8c77c32052565d96f1c5433248ba2bb4a6","observation_id":"f4a5716a-9ec9-415b-8748-d44b266bf8eb","resolution":{"observed_at":"2026-08-01T20:48:28.309504Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-07T10:46:08.274157Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-01T20:43:48.475747Z","title":"The information bottleneck method.arXiv preprint physics/0004057,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T20:43:48.475747Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2607.16554"},"observation_digest":"sha256:6c3571847026c30628068ab9dd3d43263afcbdb0a3986dd0ba3fe69f04a408b8","observation_id":"f995367d-5129-4ec1-b24c-ddeb535748fb","resolution":{"observed_at":"2026-08-01T20:43:48.475747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16554","last_updated":"2026-07-17T23:31:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T04:46:11.099210Z","submitted_at":"2026-07-17T23:31:12Z","title":"Capacity and Redundancy Trade-offs in Multi-Task Learning"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2607.16554."}