{"as_of":"2026-08-08T13:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f349773a3e2be329f552203eb65557b36144a80685b10b3eff0baa5c02bebf7c","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T11:47:10.748191Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.03953/citation-record","integrity":"/paper/2604.03953/integrity","json":"/paper/2604.03953/citation-record.json","paper":"/paper/2604.03953"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Al Haris, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:41a182e628f0b037c9f720b84b4c28cbf3bfadd46a663bded792210499dbf88b","observation_id":"c6502cc8-c6c9-41e0-80e9-940eb255d9c1","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Inferring sparse gaussian graph- ical models with latent structure.Electronic Journal of Statistics, 3:205–238, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:07ee4e89903890c7239ebd4b0c429ff0ae42c2341e7791acbdb2354da53ab82d","observation_id":"b196a235-64a8-4a76-8058-7c49d90bcc6b","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Distributed optimization and statistical learning via the alternating direction method of multipliers.Foun- dations and Trends in Machine Learning, 3(1):1–122, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:b69df2e8f956b4459e16a8dcea3adfc22b8c0a1175ee6c8d1982c707971ccd0b","observation_id":"43477164-0fae-4946-89f0-baf4cc1fa97e","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05350","last_updated":"2023-04-26T20:33:41Z","snapshot_observed_at":"2026-07-06T15:14:28.574778Z","submitted_at":"2023-04-03T09:38:05Z","title":"Astroformer: More Data Might not be all you need for Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05350","snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"cited_paper":"/paper/2304.05350","citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:477fe9508770384d078055d48799433403894a10d78ac2b9e8db2f0ee381b305","observation_id":"ce83e730-d066-41bb-af8d-e2eb20e8c691","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:dbc250f11b179e3d937b49e6988213199b42abdad172bf7ee4271135aa880aa0","observation_id":"5f89aa9d-465c-4214-8ec7-95e697508980","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:27feb1fa5b653462028aba2ec977560eea5ac0ffda1c08158ac47c9926c36f7f","observation_id":"24129932-bc82-4d24-a202-2d8970c0df25","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:e6f63071a1dcd3e6afce95fec873b6ebd4dea8dbc88dc3010100db505cffdc56","observation_id":"47a1cadb-a83a-460d-bfa3-13808323980d","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:d1f17f5dcc5db2e15cc668d2ab069e719a0ea30c464c09ed8a18d9038de21858","observation_id":"3c00fc00-3b81-4491-acd5-32d2b4718f78","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:df5342853017702b5a301568d70ce9ada52afe15b43b5e98f83f6cea11647e1d","observation_id":"6b5c8e77-d489-4135-bcbc-43fd28ce42b9","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Extended bayesian information criteria for gaussian graphical models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:4b8f4ad1111009e842a8e8afe0451f53dca490ba3cec09963a5e4bc805c129b6","observation_id":"e2fea6e2-29df-4dc3-a37c-cb8213007ab3","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Sparse inverse covariance estimation with the graphical lasso.Biostatistics, 9(3):432–441, 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:976d317dfc54c18fd79a3354f2c1a39afe723c716b4cc4fbecccc3ad72dc95f2","observation_id":"1617847d-8639-4785-83c7-ac08d9608a1b","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:dcdfbf770817690d64f707902bcb122ae83b3439c92765dbbf2b7adba8ed5953","observation_id":"b980c244-e691-44fb-b080-0370716e9768","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Caltech-256 object category dataset","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:db21d52e9c09d3bcc802c545bad479a9a90050a279f93da361d580062d884c12","observation_id":"e5160365-14b7-40d2-b7ad-81fd887679b8","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Learning a common substructure of multiple graphical gaussian models.Neural Networks, 38:23–38, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:d68fdf73225cb1990cce6946099d86b3114b91dc8b82c6744a6f8f3b3e2e5a87","observation_id":"06bab38a-26bb-414e-b04e-8ba878646c2c","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Hyun and H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:c185b6ba3d3de446c3bf2f23e70dbf7a5de4045b37dbad268efeef51a2504075","observation_id":"2935f9b3-ea1c-4eaf-a268-4664971b8657","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Jahanaray, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:e227880b05a767ab13ae3d2b809b1a2ccd0818faa6aa7ea51ffb25350fad17ae","observation_id":"960a2138-4e0f-4266-b969-f1a037734a6d","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Oneformer: One transformer to rule universal image segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:336055583eeab277311084438766ce0cbbf1984a0de5194104102f05e597c3f9","observation_id":"42df8338-17cc-4ade-a51d-9777e7e4dc4d","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Smedsrud, Michael A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:06d4298d28b72056563366ba0fdfce699188557616680316712939e5ae64c8ee","observation_id":"c1d73cfd-f4a2-4ddc-b153-ad82b688f148","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Jia et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:3beffd3c8128beacbd5cbed5dcd00f113f5f1bc9d1679c7845d3dff3334e5fde","observation_id":"021563c1-1060-4137-bcfb-773cbd1d7d37","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:7d92a65419946e40e3ed6adc1e3e67707a129c81317c0dd60c1c554a9b478706","observation_id":"1a7918fa-a52d-40b4-a25d-15cef1f49e05","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:c84a05ffc18c4bbb054db84fe20969f647cd40e5062cf98224784b9a57699367","observation_id":"d4118064-e559-4c6c-87da-593b8baa3f15","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Lawrence Zitnick","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:4d16aad971baa9a8f648b47d1761729b6a7958a1872cdb90713b7464f913baf4","observation_id":"c93eb097-68be-4786-8075-08d9d3c32ae2","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:d892430db27680b29172c56586a79d1a3d518325a5c30bf0e689ca826b0ff61c","observation_id":"f30feca1-fbaa-4ccf-b902-e8a51efbec95","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Lingjærde, B","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:af396e284e45391b86bfe2a1b673febef0aa139f41c2faf12a6216499780e2c1","observation_id":"5628d32e-4f17-4a3b-88e7-0870913918fc","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:2bf153101a021f087de934ac20ce91eb822b8edf30d1c2c8c627a439b74a684c","observation_id":"0c269802-3b7d-453e-9e0c-04b962b4a34e","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"The nonparanormal: Semiparametric estima- tion of high dimensional undirected graphs.Journal of Machine Learning Research (JMLR), 10:2295–2328, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:b29ce0aef519cd6de01ab3e631b9f9be34a549d60654f43ff5cb7d447979cef3","observation_id":"bab28396-200c-4dc2-b949-3e925d0a6977","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:4192cb96f70076c23499bce86cb78e65615af08c5c979f8c83256e7c2b5035ff","observation_id":"df4d9812-5111-439d-bd36-b43a3e9c6d8e","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02653","last_updated":"2024-02-05T00:52:50Z","snapshot_observed_at":"2026-07-06T17:25:14.115360Z","submitted_at":"2024-02-05T00:52:50Z","title":"Learning with Mixture of Prototypes for Out-of-Distribution Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02653","snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Lu et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"cited_paper":"/paper/2402.02653","citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:f9337bcfcd64572b49ebc40318862687028cfe16682741018389bc042d5a1f2e","observation_id":"e38c8e84-3916-4dd7-bb45-919ddf79fc11","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Shufflenet V2: Practical guide- lines for efficient CNN architecture design","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:a9214fc54295ffb64d0fc5acc1fb47046a123940bd450f480483e41066a0e657","observation_id":"8c97d973-346a-4f7f-aaee-afa53df420e0","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:aee93d299dcabadcd7ce8ff5ca345b196515f4f844755649d421edc504d31d32","observation_id":"db9c168b-c4bb-414d-8f1f-4e029211f58c","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Ren et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:72a5627253da816500507b0d82e8ce712285ce3a87307c71afee1d1e5d1eedfb","observation_id":"044083ad-efe7-46a3-ba99-a8e758f499b7","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Rong et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:8302967c6fadbcd100f7aea4210091fa4b36b8b045399c8f9c5b4b78202fc3ab","observation_id":"f9c844b4-ae27-4606-8e14-811cb9fc5190","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Shang et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:01fe3858a039875dc5ce802b7b8de4056c21cbf163a3a9f4a95f89968192b0e5","observation_id":"7f3963ff-4192-4e27-abd9-e5ece10136af","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:a86fd922cad88bb54d4dee7d429da5700186c7d52423314247924b75191deca6","observation_id":"9ceb0548-71e7-4f08-95dc-79f3d4ad4741","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Scene labeling using sparse precision matrix","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:1a7d9fda520df3bed8090574cf5a22cf905721c93acc7eeb79c1847924229144","observation_id":"084d60a2-440b-4621-b360-bb521fff6074","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Srivastava and G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:92d5536bec8e3c943d613adfe8421492adf3390329443118b36e71546bed0262","observation_id":"421573c7-2214-43fa-9e6e-7f531b4b8711","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"PaliGemma 2: A family of versatile VLMs for transfer.arXiv preprint arXiv:2412.03555, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:ad0737254ad6764b8cb2b4c96357f906e584fa3d811001b4f9de76967ffb22b9","observation_id":"83eb41a0-6715-4b56-9d36-31da66e4f875","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:2ddd2da4d4e36dbf94dfef367bfe02c69c34292acf9c3db684425334debbbf9c","observation_id":"07db8567-bdca-4a0c-a6a1-6b8fef9ad9ed","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"SigLIP 2: Multilin- gual vision-language encoders with improved semantic understanding, localization, and dense features.arXiv preprint arXiv:2502.14786, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:040bc0f929aef5d0f15947f0e65cf2bdc37c80d5da6aea419a2ce82e01667d13","observation_id":"eaf45950-6f62-4b21-990f-100b1f55de30","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"The caltech-UCSD birds-200-2011 dataset","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:ce9a632cc0cc29fd13bb768a5d7ae2c01a778380ff918242da07378d52ba05cd","observation_id":"b6b87a70-9c0e-4ca8-9764-a41237ee3f4a","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Internimage: Exploring large- scale vision foundation models with deformable convolutions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:699135fad0c1ef9ef880b6f478fdad3c25b9d7d98053140042f6bf16aba5711f","observation_id":"dfcdbb6f-99b8-4863-a47c-b677a9a9fc93","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:0c0774e54e28eb603b95be0d9cc59058465e53d813657f945c9f7757e182825c","observation_id":"74d4b61f-0991-4151-9afa-11b997c7b9c8","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:9bbf8f6fea240273103cc98a075ab2da4518bdb4b64d22e7df08f0f2d2287098","observation_id":"10e68af4-d8d0-4eb6-a3de-ddb8853368ae","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Groupvit: Semantic segmentation emerges from text supervision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:1c07a7de1a9f58a29c8411921526f1d96538b49b382125c9396cb8155479a79e","observation_id":"22da2e38-53c0-4a91-b7de-c60d5722af7f","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Xu et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:78624ee35ccc4165aad1479f1ea0ebcc70a86aa94bb421c53b0c4a3bced345c6","observation_id":"24b685f4-38d1-4ee4-918c-2f3720e1e55e","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Zeng et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:d728cf4a48a25dcc3c3960e823cc34929cc5ccea2afe72bf11264eb8b8d5d31d","observation_id":"324fe00f-771a-4dbe-991f-5e2f2b9aa375","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Sigmoid loss for lan- guage image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:9921e84b5a424a79917780d25cb9d852257302ab74627ea52083a6dd49d24112","observation_id":"abf6ba02-a448-4b4b-96dd-09a30132b138","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:71a0d99fe5a747db07bd1866c1491d1d26a66f46b34c45d75bade0be929636bc","observation_id":"17ee819d-a78a-49d9-b1c1-e09827c28592","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T11:47:10.748191Z","title":"Semantic understanding of scenes through the ADE20K dataset.International Journal of Computer Vision (IJCV), 127(3):302–321, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T11:47:10.748191Z"},"links":{"citing_paper":"/paper/2604.03953"},"observation_digest":"sha256:c704b91e267d9a356976b92634a345200a6d19b6429f6fa364395c7f983e6d37","observation_id":"ccb0a2b8-92b2-43ec-b6ef-b4a5df594075","resolution":{"observed_at":"2026-07-13T11:47:10.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2604.03953","last_updated":"2026-04-05T04:07:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T17:51:24.638752Z","submitted_at":"2026-04-05T04:07:59Z","title":"Multimodal Structure Learning: Disentangling Shared and Specific Topology via Cross-Modal Graphical Lasso"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2604.03953."}