{"as_of":"2026-08-08T02:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b50d62d4da9d40dfbd6cf25dae3c7c53cb8c3e3c7d529bd261f8b5ab5b0769aa","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:22:12.519192Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17673/citation-record","integrity":"/paper/2607.17673/integrity","json":"/paper/2607.17673/citation-record.json","paper":"/paper/2607.17673"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:03.163804Z","title":"SineProject: Machine Unlearning for Stable Vision-Language Alignment , booktitle=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:03.163804Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:b27c052e91265c42ebc36c788211f91177528a00a18bb49f2fd13254d86bfee3","observation_id":"a0e18a5c-3263-46a9-8fad-ed2322484323","resolution":{"observed_at":"2026-08-01T17:22:03.163804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.05328","last_updated":"2026-06-03T18:11:51Z","snapshot_observed_at":"2026-07-06T23:45:19.055840Z","submitted_at":"2026-06-03T18:11:51Z","title":"The Invisible Hand of Physics: When Video Diffusion Models Know More Than They Show","version":1},"cited_work":{"arxiv_id":"2606.05328","doi":"10.48550/arxiv.2606.05328","metadata_source":"pith","pith_arxiv_id":"2606.05328","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"The Invisible Hand of Physics: When Video Diffusion Models Know More Than They Show","venue":"cs.GR","work_id":"2b2573c3-3db9-47c7-91ed-e0bad55fe609","year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:03.303891Z"},"links":{"cited_paper":"/paper/2606.05328","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:2e3a3cde57aa9e86401e0c3f229942544dfe3eeab601d270191983ad63ce56bb","observation_id":"8fc011d3-934f-4842-8ead-8827f1675b44","resolution":{"observed_at":"2026-08-01T17:23:21.578215Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:03.445118Z","title":"doi:10.5281/zenodo.3828935 , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:03.445118Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:6796f3f3ad65c56c551c6e543c1c63b73e7ac6c52c70bcd24495892814c2b0e9","observation_id":"760254bc-e11d-48d8-b175-d34998980c83","resolution":{"observed_at":"2026-08-01T17:22:03.445118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:03.529246Z","title":", editor=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:03.529246Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:2511efaa0ee723ddb693153fdd79a5f8e908173ec01ab54bc61c8897f64bd997","observation_id":"f0bfacdf-3625-45ef-8f77-4efe15b67b6a","resolution":{"observed_at":"2026-08-01T17:22:03.529246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:03.637800Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:03.637800Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:95c55368887bb9ec6a00559fd9b3a84f9a521cc239bd1fa39a0cbc24454fe9c0","observation_id":"b46e090b-c607-4bc6-ab93-ecb794212047","resolution":{"observed_at":"2026-08-01T17:22:03.637800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:03.784593Z","title":"Contractive Auto-Encoders: Explicit Invariance During Feature Extraction , url=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:03.784593Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:f4e13c1f3feb6276c542fdb70ed8e03ab1d68b278236ecb8767f9b1b3e64918c","observation_id":"74ad47ed-4a76-4eb2-a365-7a830eaaf221","resolution":{"observed_at":"2026-08-01T17:22:03.784593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:03.890529Z","title":"and Paiva, Ana , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:03.890529Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:f7e9087ef9c8c9b4b840fb155d5b3af34fd79f413b2b01c1232ccda19e604508","observation_id":"2a42a069-4fcd-4665-a406-e99782d9a26d","resolution":{"observed_at":"2026-08-01T17:22:03.890529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:04.011813Z","title":"Understanding Contrastive Representation Learning through Alignment and Uniformity on the Hypersphere , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.011813Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:67e186070e744e846b383c2b0b9643ae50ce72d6055f702b1aea780271fe9821","observation_id":"31ad7c66-428b-4d5c-94a9-919502648e09","resolution":{"observed_at":"2026-08-01T17:22:04.011813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:04.067607Z","title":"Advances in Neural Information Processing Systems , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.067607Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:09a608c261313641300a1a6f3e8545d22aada37c02919a352f12d95476dcf1c7","observation_id":"a19fdb25-e0b0-4f49-8aea-e580aeb461e3","resolution":{"observed_at":"2026-08-01T17:22:04.067607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:04.137871Z","title":"Decipher the Modality Gap in Multimodal Contrastive Learning: From Convergent Representations to Pairwise Alignment , url=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.137871Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:1b7f2d59edfb459d3613004086476b1039d13f2b9a35d0485bd0ffa3a6b065e6","observation_id":"93c787c1-8bbf-4450-8b3a-f9629c9f8c0d","resolution":{"observed_at":"2026-08-01T17:22:04.137871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:04.221345Z","title":"The More, the Merrier: Contrastive Fusion for Higher-Order Multimodal Alignment , booktitle=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.221345Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:991d5d6f73d41e339abba03e2fad134d8b9ce1816f7eca5d9b8a58e0640c96a1","observation_id":"8e3d1499-c4f7-4e0a-8658-a92e9cad1b91","resolution":{"observed_at":"2026-08-01T17:22:04.221345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:04.340034Z","title":"Dahl and Justin Gilmer and Christopher J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.340034Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:b09b123f88ecda91cd31d452185bf9987cfea855b47bf688c86d089058eeb074","observation_id":"61f3bef8-d4f6-4408-a96e-672ea54d3f23","resolution":{"observed_at":"2026-08-01T17:22:04.340034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:04.439176Z","title":"Rectifier nonlinearities improve neural network acoustic models , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.439176Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:a378a033f518aa6dcff4233f786e0fba969f54b1a2973558e8bc2e98f2439e9a","observation_id":"5adcbe55-3d14-4cb4-8a68-a1397d621a8a","resolution":{"observed_at":"2026-08-01T17:22:04.439176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:04.533373Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding , url=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.533373Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:50ea63633f4a717e8f8d1e033e7d8374d15eb0ad34dc18cf5e8314ffff64a535","observation_id":"df59bfad-c25f-4ee4-981e-5d74b436cfb5","resolution":{"observed_at":"2026-08-01T17:22:04.533373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:04.728197Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.728197Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:5b00957c9482680bb9c0cd26dc3cf12551b4a7826e3114f460772cc88100ca7b","observation_id":"42b95e41-74fd-4c74-be86-94126080bfdf","resolution":{"observed_at":"2026-08-01T17:22:04.728197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-01T17:22:04.909655Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models , url=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:04.909655Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:df598bd849ea8c5c740ce23374dfd3365bf99ea393eac72a12a26e8b395028dc","observation_id":"23a323f9-c961-4f4a-bc4b-e84cb0d3ff78","resolution":{"observed_at":"2026-08-01T17:22:04.909655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16791","last_updated":"2026-05-07T07:56:53Z","snapshot_observed_at":"2026-07-06T21:28:38.694043Z","submitted_at":"2025-05-22T15:32:50Z","title":"Cohort-Based Active Modality Acquisition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16791","snapshot_observed_at":"2026-08-01T17:22:05.002461Z","title":"Cohort-Based Active Modality Acquisition , url=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.002461Z"},"links":{"cited_paper":"/paper/2505.16791","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:20b874dbeceedcd5866c927f4787982c27d3d897aabd52c3e36fea63bb9457a2","observation_id":"12f79fb6-403c-4783-8da6-3029c43eda59","resolution":{"observed_at":"2026-08-01T17:22:05.002461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.22991","last_updated":"2026-05-07T08:56:54Z","snapshot_observed_at":"2026-07-06T22:40:12.666349Z","submitted_at":"2025-12-28T16:20:36Z","title":"Fusion or Confusion? Multimodal Complexity Is Not All You Need","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.22991","snapshot_observed_at":"2026-08-01T17:22:05.132238Z","title":"Fusion or Confusion? Multimodal Complexity Is Not All You Need , url=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.132238Z"},"links":{"cited_paper":"/paper/2512.22991","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:3aed5c2ecfb7f636cf62edc949fa26c139a79107fc83ff9166f888b1dd541465","observation_id":"50f8a6fd-47f8-44dc-bcd4-ac3c4ec68ff0","resolution":{"observed_at":"2026-08-01T17:22:05.132238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.196955Z","title":"Understanding Dimensional Collapse in Contrastive Self-supervised Learning , url=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.196955Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:e80f90baf5e780d70bbeb7104851b5f1f1648bffea4f08778114514f61de677b","observation_id":"850ad220-c34e-43bc-b54c-223e8111731c","resolution":{"observed_at":"2026-08-01T17:22:05.196955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.318124Z","title":"Dynamical Isometry is Achieved in Residual Networks in a Universal Way for any Activation Function , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.318124Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:7b9fa5424b0aecba8fa6a3232845316b5a9e389e7a6e674eece5cf529dc7a52c","observation_id":"0b56169f-fbcd-4353-a451-51b808dfb962","resolution":{"observed_at":"2026-08-01T17:22:05.318124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.415299Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.415299Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:03e7f8c2870aceff6d6b82d3e8353b34069cf3af5a8ad3dddf169d0cbc45f93c","observation_id":"98c54f53-ad6d-44eb-9ff3-b66f7df574b0","resolution":{"observed_at":"2026-08-01T17:22:05.415299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.478127Z","title":"First Workshop on Pre-training: Perspectives, Pitfalls, and Paths Forward at ICML 2022 , author=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.478127Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:6af5bebfe7c8ed6c85ebda148ded6bb6cacdbd6339f898403fdc1b3611b4c78b","observation_id":"d7c17dff-de81-4e48-b504-86e5a67753ea","resolution":{"observed_at":"2026-08-01T17:22:05.478127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.02729","last_updated":"2019-08-07T17:04:26Z","snapshot_observed_at":"2026-08-02T17:37:17.740273Z","submitted_at":"2019-08-07T17:04:26Z","title":"Robust Learning with Jacobian Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.02729","snapshot_observed_at":"2026-08-01T17:22:05.595563Z","title":"and Yaida, Sho , year=","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.595563Z"},"links":{"cited_paper":"/paper/1908.02729","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:efd24f1641a8777c8b5b8b3c795c4769290d4cd823b620166b8eaea316e26134","observation_id":"069c99b4-5e74-43ee-9a40-d0a1758c352f","resolution":{"observed_at":"2026-08-01T17:22:05.595563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.711770Z","title":"Dynamical Isometry and a Mean Field Theory of CNNs: How to Train 10,000-Layer Vanilla Convolutional Neural Networks , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.711770Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:46e89507a5898fcd6a240eca8aca8437627d7d1f0a3eaec1b2957ad92ed51347","observation_id":"0fe37527-7650-4dd4-8413-e22fdbcc54ae","resolution":{"observed_at":"2026-08-01T17:22:05.711770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.777084Z","title":"Initialization of ReLUs for Dynamical Isometry , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.777084Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:4d273342b8c03eb6113d63a1430e259c0f9267782fe05661d88600c5d8c8291e","observation_id":"be06a301-71e6-43d3-8614-dffb6d2b0d24","resolution":{"observed_at":"2026-08-01T17:22:05.777084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.831469Z","title":"Advances in Neural Information Processing Systems 30: Annual Conference on Neural Information Processing Systems 2017, December 4-9, 2017, Long Beach, CA, USA , author=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.831469Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:50ba1bf92810e45d0fff198db176984055a13fd138981a1ac4a644e9276a0550","observation_id":"3b04e692-1091-404b-9121-d8afaa513691","resolution":{"observed_at":"2026-08-01T17:22:05.831469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.888696Z","title":"2nd International Conference on Learning Representations, ICLR 2014, Banff, AB, Canada, April 14-16, 2014, Conference Track Proceedings , author=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.888696Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:a6cfde36a9558864451049832f33cfa000aa633a656eadc6acee35c043d67f48","observation_id":"b91ef554-ad27-4990-b712-fd9c241db70e","resolution":{"observed_at":"2026-08-01T17:22:05.888696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:05.954680Z","title":"and Gilmer, Justin and Ganguli, Surya and Sohl-Dickstein, Jascha , year=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:05.954680Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:1f822e6f726aa065c6a18051175f4cd1ef87d153dc0a3d8cef976d08b7dfe3d9","observation_id":"3dfe612f-1b1a-4d94-87a5-2398578988c2","resolution":{"observed_at":"2026-08-01T17:22:05.954680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.064272Z","title":"Always Skip Attention , booktitle=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.064272Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:92f8bbd33710f351ec973c722942c8104ec6b99e80c983f0a9ee3aefcdf3597e","observation_id":"0a3b7e5a-0a7b-4305-be9c-740acc306ba3","resolution":{"observed_at":"2026-08-01T17:22:06.064272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.126429Z","title":"Improving Transformer Optimization Through Better Initialization , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.126429Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:c8becdeb145231b46abdd2cc7323ff37fc79cf092f88c36b173b47baa91b964f","observation_id":"5f62431f-b8a8-4e40-8b56-b2d5a7723253","resolution":{"observed_at":"2026-08-01T17:22:06.126429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.258796Z","title":"Attention is All you Need , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.258796Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:f42a1c41fbdaad78f545ba622920c9464ef659aed89835d6ce814b6e40faa544","observation_id":"e1463eb3-a824-493b-a84e-6d48522d288f","resolution":{"observed_at":"2026-08-01T17:22:06.258796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.404306Z","title":"The Thirteenth International Conference on Learning Representations , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.404306Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:bccf2dc172653c78acab6000599a8d7dc7a2c1cce6f8d2b896ba87b8d81502f5","observation_id":"5165dcda-c1ea-44b9-b711-001ea08d0f9e","resolution":{"observed_at":"2026-08-01T17:22:06.404306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03165","last_updated":"2025-07-03T20:45:37Z","snapshot_observed_at":"2026-08-06T20:14:20.891065Z","submitted_at":"2025-07-03T20:45:37Z","title":"PiCME: Pipeline for Contrastive Modality Evaluation and Encoding in the MIMIC Dataset","version":1},"cited_work":{"arxiv_id":"2507.03165","doi":"10.48550/arxiv.2507.03165","metadata_source":"pith","pith_arxiv_id":"2507.03165","snapshot_observed_at":"2026-08-01T18:16:15.623592Z","title":"PiCME: Pipeline for Contrastive Modality Evaluation and Encoding in the MIMIC Dataset","venue":"cs.LG","work_id":"f342de7e-04ca-4379-a7a7-480c4a34fcb1","year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.469185Z"},"links":{"cited_paper":"/paper/2507.03165","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:ee1d257861b1258d075de36f602769235d54ebf26cba82113ff0275618d41397","observation_id":"a3dbb09f-687f-4f7a-9820-eb6db4491d46","resolution":{"observed_at":"2026-08-01T17:23:20.809461Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.536912Z","title":"Sigmoid Loss for Language Image Pre-Training , booktitle=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.536912Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:a02f248eb24256dcf66c9c981137fdd7f18afa4292b1eae98eed526e01c81283","observation_id":"eceb510f-e82f-422e-8abb-74cd18824f51","resolution":{"observed_at":"2026-08-01T17:22:06.536912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.618873Z","title":"LiT: Zero-Shot Transfer With Locked-Image Text Tuning , booktitle=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.618873Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:5dfccd8d59627a0a37beb8255502b6c00307747136e58e1b617283b8cfd58ac5","observation_id":"dfba4d1f-503f-4a31-b14a-2dede3a8c728","resolution":{"observed_at":"2026-08-01T17:22:06.618873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.670324Z","title":"and Sung, Yun-Hsuan and Li, Zhen and Duerig, Tom , editor=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.670324Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:3154eee13f613f65d8f6bc8494e39d5c688d39327cc647832bd7d018d5b5fb79","observation_id":"45ead472-870a-40af-a702-be318606252b","resolution":{"observed_at":"2026-08-01T17:22:06.670324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.752802Z","title":"International Conference on Learning Representations , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.752802Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:9048319d3a5b200d134d73ae5dbccca07aa3f52f11f0b6852aebf6342236a542","observation_id":"18391f57-2d13-4fe7-bff6-bfc5470829ef","resolution":{"observed_at":"2026-08-01T17:22:06.752802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:06.900503Z","title":"Circulation , author=","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:06.900503Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:c949f85e08748358f6ea4f1744bc3efe42823851b0f5b75645bbb27be0a68c64","observation_id":"b09119ac-d575-4693-aec6-59299b775a09","resolution":{"observed_at":"2026-08-01T17:22:06.900503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.163384Z","title":"Multimodal Clinical Benchmark for Emergency Care (MC-BEC): A Comprehensive Benchmark for Evaluating Foundation Models in Emergency Medicine , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.163384Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:3a21ca910b34c8e301c552e25dc9d9874f63ba1bf2de7773dad4061b0efe17cd","observation_id":"2cf5af1c-ea79-42de-a8bc-513b0dcd205c","resolution":{"observed_at":"2026-08-01T17:22:07.163384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.249249Z","title":"Scientific Data , author=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.249249Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:c863cff6fa82b34782d4c0500f8d936b1c687dd39a7906a832dd3ec05522784b","observation_id":"ea1d4444-3696-4048-a996-f27139b1b3e2","resolution":{"observed_at":"2026-08-01T17:22:07.249249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05834","last_updated":"2026-05-07T07:23:06Z","snapshot_observed_at":"2026-08-07T00:25:25.000753Z","submitted_at":"2026-04-07T13:03:30Z","title":"Hidden in the Multiplicative Interaction: Uncovering Fragility in Multimodal Contrastive Learning","version":2},"cited_work":{"arxiv_id":"2604.05834","doi":"10.48550/arxiv.2604.05834","metadata_source":"pith","pith_arxiv_id":"2604.05834","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Hidden in the Multiplicative Interaction: Uncovering Fragility in Multimodal Contrastive Learning","venue":"cs.LG","work_id":"12c6ccdb-a87d-4a1b-bdfa-8309c05f8834","year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.303415Z"},"links":{"cited_paper":"/paper/2604.05834","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:b2e0528edf012c65bf0289789a276f5bea7f3a8c1e359dd61e87983ea8be6845","observation_id":"e3541546-746a-4018-a598-1681b95030ec","resolution":{"observed_at":"2026-08-01T17:23:20.278476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.391763Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.391763Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:3d04f5b3fb95134c5208981084ec88e286efbc37983091d9c51c4df6afdab798","observation_id":"0b28c319-e126-4780-ab91-c4b273356fe5","resolution":{"observed_at":"2026-08-01T17:22:07.391763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.463535Z","title":"The Thirteenth International Conference on Learning Representations , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.463535Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:4840caeff4d360587529fffebee82db79bddc4e373249b1b67b2477bad5f0c0e","observation_id":"c9716b5a-92a6-487a-b91f-8d872298d247","resolution":{"observed_at":"2026-08-01T17:22:07.463535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.529529Z","title":"Learning Transferable Visual Models From Natural Language Supervision , url=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.529529Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:1103ff979a746fc69a309d0c26d5f2a7a2c664c597ff0984e2c245113e4b02d9","observation_id":"51ae45fa-21f6-40c8-8b86-c13c338d4bda","resolution":{"observed_at":"2026-08-01T17:22:07.529529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.597989Z","title":"The Thirty-eighth Annual Conference on Neural Information Processing Systems , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.597989Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:bf1dd8c83cf28401288e8249f63bede5d60bfa7f9cb16712ea5375a1d51ed01e","observation_id":"00ef6c7d-255d-4fcf-98bc-76767ed2d743","resolution":{"observed_at":"2026-08-01T17:22:07.597989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.716553Z","title":"Acosta, Guido J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.716553Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:d079a6bf7aa18bd1cdc9d71e403821a93bc4f117940850b33688983fd0047dcf","observation_id":"e60ab333-9d96-401d-ab6c-611b02e2adfe","resolution":{"observed_at":"2026-08-01T17:22:07.716553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.788450Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.788450Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:57e65eaa0348e9c5bf2b8114c8a133bac98bab71063435d1ab41bc0751ed6ff2","observation_id":"c3e0cc60-597d-4b98-88a9-a22954b99db4","resolution":{"observed_at":"2026-08-01T17:22:07.788450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:07.863827Z","title":"Initialization of relus for dynamical isometry","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.863827Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:5a4f5b0bfc96a5fdceb2f9f813d9ea5c666ee22f427d6342b0663a4901f43f3b","observation_id":"042e885a-07a5-4120-a7bf-1166ced6c01f","resolution":{"observed_at":"2026-08-01T17:22:07.863827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.19597","last_updated":"2026-05-31T04:27:45Z","snapshot_observed_at":"2026-08-06T13:24:21.239864Z","submitted_at":"2026-01-27T13:33:03Z","title":"The Geometric Mechanics of Contrastive Representation Learning: Alignment Potentials, Entropic Dispersion, and Cross-modal Divergence","version":6},"cited_work":{"arxiv_id":"2601.19597","doi":"10.48550/arxiv.2601.19597","metadata_source":"pith","pith_arxiv_id":"2601.19597","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"The Geometric Mechanics of Contrastive Representation Learning: Alignment Potentials, Entropic Dispersion, and Cross-modal Divergence","venue":"cs.LG","work_id":"acbd1aee-c604-4d08-983a-781e0d587ee5","year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:07.962453Z"},"links":{"cited_paper":"/paper/2601.19597","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:97a365b1cbc885cfdca9df878a1dff82ccf4e1c2f0f494412136693159513b1c","observation_id":"20dee561-1687-46e3-ba98-b35bb28a0570","resolution":{"observed_at":"2026-08-01T17:23:21.327514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.040674Z","title":"A triangle enables multimodal alignment beyond cosine similarity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.040674Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:4ed155ab1307eb3f506b8430c0488e2df29909eaed8abec2153cfaf67107a28e","observation_id":"fe46c7d5-a2c3-4a70-896d-043b617dede7","resolution":{"observed_at":"2026-08-01T17:22:08.040674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.107252Z","title":"Gramian multimodal representation learning and alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.107252Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:969e26c3494e198821fe942561ca25483efc20d4832fa2d9d99dca7de8301187","observation_id":"cf23a357-8fd2-4ce7-bb5e-ed38210703cf","resolution":{"observed_at":"2026-08-01T17:22:08.107252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.159503Z","title":"The road less scheduled","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.159503Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:51c9a35762d784e704017c5962c97857e819364784e0ffc3671cdce62e7e5c04","observation_id":"7da61813-3f0c-46c2-8840-a914e7e5940b","resolution":{"observed_at":"2026-08-01T17:22:08.159503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.220589Z","title":"What to align in multimodal contrastive learning? In The Thirteenth International Conference on Learning Representations, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.220589Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:48737a8af30b0e14c683cabb72202c956455f5ec4a0612c07a9cf2a557844b0a","observation_id":"3baa9ee8-a090-437a-a717-eb5120b84bdd","resolution":{"observed_at":"2026-08-01T17:22:08.220589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.05328","last_updated":"2026-06-03T18:11:51Z","snapshot_observed_at":"2026-07-06T23:45:19.055840Z","submitted_at":"2026-06-03T18:11:51Z","title":"The Invisible Hand of Physics: When Video Diffusion Models Know More Than They Show","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.05328","snapshot_observed_at":"2026-08-01T17:22:08.280716Z","title":"The invisible hand of physics: When video diffusion models know more than they show","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.280716Z"},"links":{"cited_paper":"/paper/2606.05328","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:316040ad5938c912b392dfac72dfc768e7a466a2b9e7e8a750dfe519f6d29d73","observation_id":"b7c0f202-b7b0-467f-84c3-158f8de936aa","resolution":{"observed_at":"2026-08-01T17:22:08.280716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.334261Z","title":"Pytorch lightning, March 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.334261Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:9897aa3505b1c981b2c55e2c9a1f5a9dc3f4d7d1ebf9e9082540ea9402bfc9d6","observation_id":"07070645-6849-4598-80d8-f5d0875dc3a7","resolution":{"observed_at":"2026-08-01T17:22:08.334261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.414805Z","title":"Sineproject: Machine unlearning for stable vision-language alignment","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.414805Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:6ece99059a841003965eb0bf8ec0e4b5c60ca5fa9cd778a7ec1db15ccf091431","observation_id":"3cdf067a-0c75-455c-a865-7033b21783c7","resolution":{"observed_at":"2026-08-01T17:22:08.414805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.530478Z","title":"Dahl, Justin Gilmer, Christopher J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.530478Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:62aa4d7ce38f989667bfbb5622dd72789639ecafd2c27ba1e8e040f7f9cba5cf","observation_id":"2beaf4cb-175c-4dd7-8086-39cb71139f39","resolution":{"observed_at":"2026-08-01T17:22:08.530478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.673031Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.673031Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:2368f2786714f38d5470912961144edd2722a834ff5b4f421c920137aa05f987","observation_id":"214bb15b-54cd-4587-aef3-3cc5ea2aa60c","resolution":{"observed_at":"2026-08-01T17:22:08.673031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03165","last_updated":"2025-07-03T20:45:37Z","snapshot_observed_at":"2026-08-06T20:14:20.891065Z","submitted_at":"2025-07-03T20:45:37Z","title":"PiCME: Pipeline for Contrastive Modality Evaluation and Encoding in the MIMIC Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03165","snapshot_observed_at":"2026-08-01T17:22:08.763103Z","title":"Picme: Pipeline for contrastive modality evaluation and encoding in the mimic dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.763103Z"},"links":{"cited_paper":"/paper/2507.03165","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:48d50d5f716f3780e4053bd305229a53137f1ceb4e3061ecac62f1d1db2479bc","observation_id":"ac33da94-ed1b-44f2-b775-903ba491a7f8","resolution":{"observed_at":"2026-08-01T17:22:08.763103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:08.919925Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:08.919925Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:e0b95ffe97cd271c6fee1dfe4544223742adfde546b6f848a31b433bb212e4d5","observation_id":"2d2dc1ea-4a74-4d7e-a3f2-5a038260275b","resolution":{"observed_at":"2026-08-01T17:22:08.919925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-026-02915-9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:23:21.087184Z","title":"Large language models are powerful electronic health record encoders","venue":null,"work_id":"a08b047f-52f4-4d6c-899b-610ad5c34d36","year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:09.054927Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:b4dd43dc3954a1cd1c36d5c48f39c282200bb6aaea83338bfad1cb655826f4ef","observation_id":"71f42778-9060-49ce-be6e-4733219ba5ab","resolution":{"observed_at":"2026-08-01T17:23:21.157614Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.02729","last_updated":"2019-08-07T17:04:26Z","snapshot_observed_at":"2026-08-02T17:37:17.740273Z","submitted_at":"2019-08-07T17:04:26Z","title":"Robust Learning with Jacobian Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.02729","snapshot_observed_at":"2026-08-01T17:22:09.144205Z","title":"Roberts, and Sho Yaida","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:09.144205Z"},"links":{"cited_paper":"/paper/1908.02729","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:98fa8be27981c5b616185092d99e18e86c4dd3f0e3420146c55764e33128aa1f","observation_id":"b1def1c9-9141-4ef3-9fa8-75bf544d9282","resolution":{"observed_at":"2026-08-01T17:22:09.144205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:09.264231Z","title":"Hu, yelong shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:09.264231Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:a8df8653677cd36829bdf461e217cd9f48b9628da23b144ee209cdf0c352d92f","observation_id":"bd7bb2ad-4be2-4e75-aa25-01ae506f26c3","resolution":{"observed_at":"2026-08-01T17:22:09.264231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:09.385692Z","title":"Improving transformer optimization through better initialization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:09.385692Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:e75f6d516f30565bf2a265f23192faffe08f58f2b1d8860354f3eb743c5aa1ce","observation_id":"1b474ba4-d1c3-4e02-a686-1859f17e4f5e","resolution":{"observed_at":"2026-08-01T17:22:09.385692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:09.572817Z","title":"Always skip attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:09.572817Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:8f9989c780208eb9f5363140181ad06b15d4600fea0e4601d4efe282a9b87b55","observation_id":"83ba05ff-f81d-4333-9343-d2f72b0271f4","resolution":{"observed_at":"2026-08-01T17:22:09.572817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:09.675452Z","title":"Le, Yun-Hsuan Sung, Zhen Li, and Tom Duerig","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:09.675452Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:1a3618975e2e9feba2dd6f3663ed32982da02a856e9b3a7fe9b2fa77178f0f0f","observation_id":"40e3d442-13ea-4e20-b52f-d0860d2f60fd","resolution":{"observed_at":"2026-08-01T17:22:09.675452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:09.868037Z","title":"Understanding dimensional collapse in contrastive self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:09.868037Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:b16cce205c8a6a2840eef3a2b3443c0711d427773df9a8d900c04d271dc2de8b","observation_id":"de351f8e-3bd2-4276-8c38-ede1eee2aedb","resolution":{"observed_at":"2026-08-01T17:22:09.868037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:10.006097Z","title":"MIMIC-IV","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:10.006097Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:8335faea75791e04853e223b0589795dfdcb30c810d7d5baa281bc3d9cbd3033","observation_id":"cc1ba51c-e7a7-461f-a96f-b0d9538b2989","resolution":{"observed_at":"2026-08-01T17:22:10.006097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:10.123460Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:10.123460Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:23882c326c910a9ec1a75e803106d4a2cec4f758deff281a52ae95ef62ef7bdf","observation_id":"07bab4ff-d708-4523-948e-d430a36a6538","resolution":{"observed_at":"2026-08-01T17:22:10.123460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:10.274252Z","title":"The more, the merrier: Contrastive fusion for higher-order multimodal alignment","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:10.274252Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:4b47165bc3d155ef02c7c045a808928cd9b55523c51716980454b57c264717cf","observation_id":"8677aaae-4d03-489d-a2b4-b38db1a16afb","resolution":{"observed_at":"2026-08-01T17:22:10.274252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:10.401297Z","title":"Mind the gap: Understanding the modality gap in multi-modal contrastive representation learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:10.401297Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:c9bce147176170de3214380eff981c6b33a2e7df2e8e9a42c63c6bd044a37341","observation_id":"57a65132-41e0-4f8e-b6ac-9234aeba4f6c","resolution":{"observed_at":"2026-08-01T17:22:10.401297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:10.511251Z","title":"Rectifier nonlinearities improve neural network acoustic models","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:10.511251Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:ebc290e14e1a5d5e866357b57ab081993cb5bdf762577ee869347653b57e220d","observation_id":"dbe463f9-76c1-4c51-9489-914b9ca02f8e","resolution":{"observed_at":"2026-08-01T17:22:10.511251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:10.639893Z","title":"Schoenholz, and Surya Ganguli","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:10.639893Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:03d67250fc3fa922f5458fee98a54da73d9b76a183bb9a33fd98e633baf62371","observation_id":"f7734452-148f-43fc-9931-b983ca308661","resolution":{"observed_at":"2026-08-01T17:22:10.639893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:10.763150Z","title":"Melo, and Ana Paiva","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:10.763150Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:b0a7030130b9dea83774558521b887e2dbe28d4d0f5037ca65e3dd30c94acbda","observation_id":"6c39ae99-8132-4e20-a331-17b6be6db7e3","resolution":{"observed_at":"2026-08-01T17:22:10.763150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:10.898403Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:10.898403Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:02e992e7ca31357ba1ca0593cd9b65d32ce50d946f3b19814bfd4feccdf4834f","observation_id":"1a452b4b-bcb7-4b3e-947d-443d8a8e169f","resolution":{"observed_at":"2026-08-01T17:22:10.898403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16791","last_updated":"2026-05-07T07:56:53Z","snapshot_observed_at":"2026-07-06T21:28:38.694043Z","submitted_at":"2025-05-22T15:32:50Z","title":"Cohort-Based Active Modality Acquisition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16791","snapshot_observed_at":"2026-08-01T17:22:11.062506Z","title":"Cohort-based active modality acquisition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.062506Z"},"links":{"cited_paper":"/paper/2505.16791","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:c70f05ad227487d438be2a2d853de58f355dbd61e25bb13fcfe5c92715fdc958","observation_id":"c8a74d20-ee02-439e-930c-92667a1d3e61","resolution":{"observed_at":"2026-08-01T17:22:11.062506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.22991","last_updated":"2026-05-07T08:56:54Z","snapshot_observed_at":"2026-07-06T22:40:12.666349Z","submitted_at":"2025-12-28T16:20:36Z","title":"Fusion or Confusion? Multimodal Complexity Is Not All You Need","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.22991","snapshot_observed_at":"2026-08-01T17:22:11.159089Z","title":"Fusion or confusion? multimodal complexity is not all you need","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.159089Z"},"links":{"cited_paper":"/paper/2512.22991","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:673934658c081438e25151c106a0e268e8b5a4544b2d98c4f4629297c877200a","observation_id":"e45e41a2-7da0-4ebe-831b-3b56eb1016d2","resolution":{"observed_at":"2026-08-01T17:22:11.159089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05834","last_updated":"2026-05-07T07:23:06Z","snapshot_observed_at":"2026-08-07T00:25:25.000753Z","submitted_at":"2026-04-07T13:03:30Z","title":"Hidden in the Multiplicative Interaction: Uncovering Fragility in Multimodal Contrastive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05834","snapshot_observed_at":"2026-08-01T17:22:11.210344Z","title":"Hidden in the multiplicative interaction: Uncovering fragility in multimodal contrastive learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.210344Z"},"links":{"cited_paper":"/paper/2604.05834","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:abd8bf5c6031f2acbf93f83a74fa9b05d812446d0ff7424b4fdd180af0ca5b5a","observation_id":"e10cc80c-8a04-452e-bb19-c14176564b3b","resolution":{"observed_at":"2026-08-01T17:22:11.210344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.298298Z","title":"Contractive auto-encoders: Explicit invariance during feature extraction","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.298298Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:d906e6b9e453deb5101287d4e52f76895610ddf8994664f1612c23e2ca5611c9","observation_id":"58089c60-c1b1-4c9d-93e4-ec7a1123e84e","resolution":{"observed_at":"2026-08-01T17:22:11.298298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.359334Z","title":"Rosenblatt","venue":null,"work_id":null,"year":1957},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.359334Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:7df42fa3131107a9ce3dd61eb83abf1e96eec05dd0343cdbc9c6f0e07ac9fb77","observation_id":"5c32b17f-b219-4280-b872-05e3d4182611","resolution":{"observed_at":"2026-08-01T17:22:11.359334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.433144Z","title":"Contrasting with symile: Simple model-agnostic representation learning for unlimited modalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.433144Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:d6d812b5678a047276816d4437a2a3059752a9fa42eda0a961dc595547b93e08","observation_id":"cd8fb43d-5087-45c7-9c39-c4d9580423a3","resolution":{"observed_at":"2026-08-01T17:22:11.433144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6120","last_updated":"2014-02-19T17:26:57Z","snapshot_observed_at":"2026-08-01T19:05:53.906854Z","submitted_at":"2013-12-20T20:24:00Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6120","snapshot_observed_at":"2026-08-01T17:22:11.492597Z","title":"Saxe, James L","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.492597Z"},"links":{"cited_paper":"/paper/1312.6120","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:413cf5feaf2011542473eb61eca0bee79dd7d761cafe17eb4d7dd6518643320d","observation_id":"bc6d4551-32fd-4e19-875b-0e09ec9fcce5","resolution":{"observed_at":"2026-08-01T17:22:11.492597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.536815Z","title":"Learnable latent embeddings for joint behavioural and neural analysis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.536815Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:50d539715c8bd90721525544aff9bd0f07e3ddc7f8da5ffcf4aaabc85b14aee5","observation_id":"7c5a3829-093f-41ae-9737-141583db0d2b","resolution":{"observed_at":"2026-08-01T17:22:11.536815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.615346Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.615346Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:4c088c0d1370ebc44441c1982259b2abdab14b728a43291112e93317f3076cec","observation_id":"ab02273e-01ee-4714-87e9-281752b3b584","resolution":{"observed_at":"2026-08-01T17:22:11.615346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.695424Z","title":"Low rank gradients and where to find them","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.695424Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:813b837ef0d0f8f6d1c3c684301463f0b43b4387dc6d7e8c510501d2ae90242d","observation_id":"0337d0fb-65de-427d-bd1b-0c2e9724f552","resolution":{"observed_at":"2026-08-01T17:22:11.695424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.779976Z","title":"Uk biobank: An open access resource for identifying the causes of a wide range of complex diseases of middle and old age","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.779976Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:889b722c1705f2028626f2b4228d3bb55386ab0f6b19664b7e952f92011f03fc","observation_id":"b146bfad-c217-4d53-8e82-4d4a253a2422","resolution":{"observed_at":"2026-08-01T17:22:11.779976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.830817Z","title":"Dynamical isometry is achieved in residual networks in a universal way for any activation function","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.830817Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:e7c69f29006c55330f6dd60a95a34aff36a49af80dba4409c3097c163f6051ed","observation_id":"65aeef2d-f32d-4bc5-97cc-560951798d52","resolution":{"observed_at":"2026-08-01T17:22:11.830817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.911677Z","title":"Resmlp: Feedforward networks for image classification with data-efficient training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.911677Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:10b7a52bffa0c29d160c189b07deff85f85d0f649c7443fcf672b492758ee7ad","observation_id":"ed8632ad-3d1d-45b3-9a66-07217aed91fe","resolution":{"observed_at":"2026-08-01T17:22:11.911677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:11.970599Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:11.970599Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:4d3ad1cd76a63d8df3df7954edc36e7fbbd3335d65dd5ce3e5f3b30b2de8f778","observation_id":"673a3440-2900-49a7-b9ba-a5a290436d1f","resolution":{"observed_at":"2026-08-01T17:22:11.970599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:12.023552Z","title":"Deepnet: Scaling transformers to 1,000 layers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.023552Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:b26868a2e3d1502acea188d0cfef3e2222a826ac35d7b667996d10027d9f0b50","observation_id":"654838a4-56b9-4077-b7fd-00f958f5c6ff","resolution":{"observed_at":"2026-08-01T17:22:12.023552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:12.066749Z","title":"Understanding contrastive representation learning through alignment and uniformity on the hypersphere","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.066749Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:0541a4983e5cd8ef916248c98e2479a414219773fc30bfa33c07b61217f255a9","observation_id":"66008cde-a781-4117-8e1a-4bc66fa30000","resolution":{"observed_at":"2026-08-01T17:22:12.066749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:12.126579Z","title":"Dynamical isometry and a mean field theory of cnns: How to train 10,000-layer vanilla convolutional neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.126579Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:76201a55d302edc928f9e2c859ef52223a0b6a311bc6a587ece9117c9c9c9f23","observation_id":"aa367c2b-3ced-4d02-8644-ad2b94c79fe0","resolution":{"observed_at":"2026-08-01T17:22:12.126579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:12.201459Z","title":"Investigating why contrastive learning benefits robustness against label noise","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.201459Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:be3f1418ca7423e67364d5c1ba94dfe18d7cdd67a5c558a9b448059bb4ed3ce1","observation_id":"85c60a25-660e-4593-b4b4-61b0319e4712","resolution":{"observed_at":"2026-08-01T17:22:12.201459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1148/ryai.210258","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chang, Amilcare Gentili, and Chun-Nan Hsu","venue":"Radiology Artificial Intelligence","work_id":"7f3a9728-0d00-4c5c-9dfa-37b8bd63b865","year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.258458Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:883614543aaffdef3852990276d02f5c85d94422a6c7abbb2b5a838f4ef0bdc0","observation_id":"36aabb6c-2b01-48e2-ba2b-fb1091c31aad","resolution":{"observed_at":"2026-08-01T17:23:20.530185Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:12.301040Z","title":"Decipher the modality gap in multimodal contrastive learning: From convergent representations to pairwise alignment, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.301040Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:cd2c88ba4d81466f3fc926c043d343524962608e8dbd3010ff1559d1fb100a7a","observation_id":"c7a622dc-f374-4d04-ad09-5ff619d7e1d6","resolution":{"observed_at":"2026-08-01T17:22:12.301040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:12.381371Z","title":"Lit: Zero-shot transfer with locked-image text tuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.381371Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:7b5ca73b529a0b466808b6b1578e77dbf7798aba48a27e2816bfbdf879b36abc","observation_id":"9af40754-12fc-4d64-a31c-24182d434503","resolution":{"observed_at":"2026-08-01T17:22:12.381371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:22:12.456666Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.456666Z"},"links":{"citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:a4ef2c7a9b123c51a0a4071ba4dff11f1cc30c55e87e5e890088d0da90d0987d","observation_id":"41ce586a-159d-4545-a5e0-2647b0cbb9ca","resolution":{"observed_at":"2026-08-01T17:22:12.456666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-01T17:22:12.519192Z","title":"Qwen3 embedding: Advancing text embedding and reranking through foundation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning","version":1},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-08-01T17:22:12.519192Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2607.17673"},"observation_digest":"sha256:9a84dc2022d2e3da54f623712b97e78a25d701a822c76be2f02bbca2c5787f58","observation_id":"5f44d5bb-44c1-4fd6-af92-08b8ac5107a7","resolution":{"observed_at":"2026-08-01T17:22:12.519192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17673","last_updated":"2026-07-20T08:25:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T21:08:55.494615Z","submitted_at":"2026-07-20T08:25:45Z","title":"Beyond Objective Expressivity: Geometry Preservation in Multimodal Contrastive Learning"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":92,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 0 inbound Pith citation observations for arXiv:2607.17673."}