{"as_of":"2026-08-14T12:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d7d39fca3f29db088bc16b5cd74c5de0a1f6eec64985eaf9f027fbacc5ef758b","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T14:32:40.857275Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28211/citation-record","integrity":"/paper/2607.28211/integrity","json":"/paper/2607.28211/citation-record.json","paper":"/paper/2607.28211"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2108.02818","last_updated":"2021-08-05T19:05:57Z","snapshot_observed_at":"2026-08-13T18:33:17.774412Z","submitted_at":"2021-08-05T19:05:57Z","title":"Evaluating CLIP: Towards Characterization of Broader Capabilities and Downstream Implications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.02818","snapshot_observed_at":"2026-07-31T14:32:40.279767Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.279767Z"},"links":{"cited_paper":"/paper/2108.02818","citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:dc91127659db81da28707fd846b2a29a61e62147158b4008615f7d514be528b7","observation_id":"c26edcce-a659-4162-9b48-bfefc04f5c4d","resolution":{"observed_at":"2026-07-31T14:32:40.279767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.290703Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.290703Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:613cfff33116da71777d016411b5749bab4bc958f434dc4e91b21072a5f98d70","observation_id":"c59b654c-0709-466d-b33c-57a47161df78","resolution":{"observed_at":"2026-07-31T14:32:40.290703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02893","last_updated":"2020-03-27T19:07:58Z","snapshot_observed_at":"2026-07-06T08:05:24.076802Z","submitted_at":"2019-07-05T15:26:26Z","title":"Invariant Risk Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02893","snapshot_observed_at":"2026-07-31T14:32:40.299662Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.299662Z"},"links":{"cited_paper":"/paper/1907.02893","citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:7cce611687305f511345ff23267e2222588908b805107fed9b173032782f8ac3","observation_id":"b770abe6-33cd-4e97-889f-eff67e7f398a","resolution":{"observed_at":"2026-07-31T14:32:40.299662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.305803Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.305803Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:fecae3d49efe009d6a33744188de812b203f2daca9a92de30f344fca52edaa2e","observation_id":"c8458235-2684-4776-8257-c18fa3f3a88d","resolution":{"observed_at":"2026-07-31T14:32:40.305803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13181","last_updated":"2025-04-28T18:01:39Z","snapshot_observed_at":"2026-08-11T19:32:15.215968Z","submitted_at":"2025-04-17T17:59:57Z","title":"Perception Encoder: The best visual embeddings are not at the output of the network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13181","snapshot_observed_at":"2026-07-31T14:32:40.317400Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.317400Z"},"links":{"cited_paper":"/paper/2504.13181","citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:3226b8334f72a08203c070894d6aa0d76510f24f7e98c7df3e52fab1d5e56799","observation_id":"9eaa9d77-11d6-4e29-9798-6941e2536d73","resolution":{"observed_at":"2026-07-31T14:32:40.317400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.323034Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.323034Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:22b2dd489e0eb5bb62f9a0115bc3956427ab7cba8ae8456d4723f4ede1ac25d0","observation_id":"b48f1d14-8c5e-42b1-934d-22c63ea5174b","resolution":{"observed_at":"2026-07-31T14:32:40.323034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.329052Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.329052Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:5fbab6ea36f6dba63c613c5aa00ac30bebb1a5379bffd7fb598ffa66decfe02e","observation_id":"815c3b92-beaa-47ed-a573-33416de40fe3","resolution":{"observed_at":"2026-07-31T14:32:40.329052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.334142Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.334142Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:fc4efffbfe88446190b7ee8e2d3d0e466d4e317263ebe12d9d3432ee17725cc7","observation_id":"10aefaad-8650-4d38-994d-d9b86d25a913","resolution":{"observed_at":"2026-07-31T14:32:40.334142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.354362Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.354362Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:091d252ba85143a4ad1c5b8351aef593fb9b59e92c60d55f4980e9f862e7a10f","observation_id":"248f415d-35a4-4870-950d-7d1121221dce","resolution":{"observed_at":"2026-07-31T14:32:40.354362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.390236Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.390236Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:217fa8c1de38b79f89c2fe39e5a72aaf104dd9fc38ece42fc382448e98f6fd99","observation_id":"b5652c9a-01fc-4b0e-99cf-af6d35cf3512","resolution":{"observed_at":"2026-07-31T14:32:40.390236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.428019Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.428019Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:8b3557d185c9946ceba5ac507cbe7d30e675bbf907c73cd1b7a3aa31bed3a8e4","observation_id":"57467b11-4142-4e11-abbb-9195d7c95dc3","resolution":{"observed_at":"2026-07-31T14:32:40.428019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.450023Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.450023Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:26852094b04c5ef8c2b19157566c47b1e67609cff5f7ddab33d5423fa0641c79","observation_id":"08b66ab8-a345-46ec-a330-58cadb3d8a6c","resolution":{"observed_at":"2026-07-31T14:32:40.450023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.416479Z","title":"In IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.416479Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:90993ba8bc073aa1c94744c8d454946f7752a7d29f438176aebd3afc2d47b593","observation_id":"b623f55b-d620-45ac-bc8b-b7cc7a08493e","resolution":{"observed_at":"2026-07-31T14:32:40.416479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.474636Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.474636Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:2c9a6ece68675daf58ee2b4c9c53b2569824cdf8298ba38b092aa77912369555","observation_id":"f230b09e-2bfa-440e-807a-8c9168f68314","resolution":{"observed_at":"2026-07-31T14:32:40.474636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.485364Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.485364Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:2c0fc179ddefaf8fe0e083edcd80179a6aee1a28b50075105a7f03a54df99231","observation_id":"fdc91c2b-a116-4fa4-8511-c904dba54162","resolution":{"observed_at":"2026-07-31T14:32:40.485364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.491201Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.491201Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:60d518243880bd627b52641f81e9eedbbc8919bcb65963c70dd44df397e91721","observation_id":"12d8d3e4-9b43-4c76-8cae-808c02d23580","resolution":{"observed_at":"2026-07-31T14:32:40.491201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.463327Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.463327Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:1023608638ac1316fe1e6298193c406d5f29d05aed46bcaa223d15027794d5b8","observation_id":"8f3371ee-2810-4b41-bd16-4afdc23ce6cf","resolution":{"observed_at":"2026-07-31T14:32:40.463327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.522361Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.522361Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:26accd4c136f81efc71926c15dd2079eaa4e88a603d413aed97afdebae7d7868","observation_id":"3e10b644-7ad2-4453-9bbf-523083dda464","resolution":{"observed_at":"2026-07-31T14:32:40.522361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.535892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.535892Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:f6930efbc15895f58bfc6b96409986ac5179514b0544e10f3faf044f62b68260","observation_id":"62752a77-c09a-446a-a8bb-ca4c3a3614a5","resolution":{"observed_at":"2026-07-31T14:32:40.535892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.540373Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.540373Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:fd3d79fa940d860a328345381f6f4ebf7a67a5c575465647824780fcf41784cf","observation_id":"9c2e3af4-6de4-47c2-ac49-23b3bc406b9a","resolution":{"observed_at":"2026-07-31T14:32:40.540373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.502206Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.502206Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:3cf9f14e53776feb40a2a5c4028ae0b463965b4b9e5ea041b2cbdbea1756dccc","observation_id":"75a4ac81-4d2a-4a40-a8d8-7afc75388449","resolution":{"observed_at":"2026-07-31T14:32:40.502206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.568144Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.568144Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:c71048ebc453972d1e3ebee9e6760a6e0dbc52ad845e1171045f4737ff1973a7","observation_id":"ffd0952a-70cd-4008-97e3-ea1b672aa5e3","resolution":{"observed_at":"2026-07-31T14:32:40.568144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.573170Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.573170Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:937e6010eca9b1247f5801f03c62594906e8dc2bc3c5328dca7d073f4a1ccb42","observation_id":"f3488c09-402e-4c59-b052-f5ec33360317","resolution":{"observed_at":"2026-07-31T14:32:40.573170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.582647Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.582647Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:06af483a37e52d1efd033933c4c492a8fdf4687147a5d1ed56ad07fe68b664ba","observation_id":"7ca14849-f9e5-404d-8bfe-34f02bc799f5","resolution":{"observed_at":"2026-07-31T14:32:40.582647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.552519Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.552519Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:21988f21aa925ce1e1e6c459c1af7d01bcd21a7b566a224fc8666db45904f76e","observation_id":"a5005671-6923-46d8-b404-2bf48bf05790","resolution":{"observed_at":"2026-07-31T14:32:40.552519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.594675Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.594675Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:655a0ac54a5bfd03014926c0bc24077e11abb1f04b42ea1fca955795fe8cff11","observation_id":"9bce104d-5331-4d74-b7dc-d87d33b39744","resolution":{"observed_at":"2026-07-31T14:32:40.594675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.604440Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.604440Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:8d243a8cbbe75dfb96ecccb0cd0ee40cd1ca7585b3f8e8405bceff4e704d8084","observation_id":"cea681e3-0e35-4981-a865-4e18f43b66c8","resolution":{"observed_at":"2026-07-31T14:32:40.604440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.616432Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.616432Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:6f59bd47b9f2cf41245a3eb48be4206c404b770caff02fe7d17ac46ef48b957a","observation_id":"909ff73a-a579-4ead-bb7a-e431e8806994","resolution":{"observed_at":"2026-07-31T14:32:40.616432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.624196Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.624196Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:259022619183811df631e6f41754f38bbe84ad9e725ee659aca4c077124b6a57","observation_id":"ff4ed706-8005-49a2-8623-b6506e3c5478","resolution":{"observed_at":"2026-07-31T14:32:40.624196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.587456Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.587456Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:dcd037e3fba43ac8208c43d686d2285eded30349d08a219dd9871f856d5f1eff","observation_id":"27259bfe-2ee5-489a-8884-06232bf4cc2f","resolution":{"observed_at":"2026-07-31T14:32:40.587456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.646733Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.646733Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:ec787c1f4a85877b7919766dfd24e8a434fbd00f769adb39b7f941ecef0f4acf","observation_id":"bdb5a00d-3a34-4255-9615-8813e2c29542","resolution":{"observed_at":"2026-07-31T14:32:40.646733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.658324Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.658324Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:62a4a6c31d2b460da1387c2d7fa9dca702d631fbc0d362de237cc0dd33378609","observation_id":"f5845366-fdd2-48fd-a3e1-46148d43f192","resolution":{"observed_at":"2026-07-31T14:32:40.658324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.663344Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.663344Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:9b2d7cc61499baed2e1f907c7f4eb7306c0d950cd03b909f06bb22deb46deed4","observation_id":"ea5dec7c-ea08-48da-9684-02d10f21cf34","resolution":{"observed_at":"2026-07-31T14:32:40.663344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.634333Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.634333Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:75d221d895cad4824afcec005e2710c171145541f6cdd1f7183de2038303ce5e","observation_id":"29f45fa3-49f4-40e5-ad2b-67a08ed6124f","resolution":{"observed_at":"2026-07-31T14:32:40.634333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.718859Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.718859Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:367a6d16c9ccc34392eb602af0073ace83d5c5408fe4e20921e2c2a53a2feb50","observation_id":"54a9673b-d6be-4bbe-b617-82c78f3d1db3","resolution":{"observed_at":"2026-07-31T14:32:40.718859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.729223Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.729223Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:3771767d69528d64a8ae1211982ee3efd7656a01be3e38309f9418588e1e497c","observation_id":"037fefe9-a9a7-48b0-8964-c606c13e8bda","resolution":{"observed_at":"2026-07-31T14:32:40.729223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.739158Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.739158Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:10684aed071de993a849233dfade5870eed9d34b6c1daf7409787854b3c19e09","observation_id":"c59f0bba-b1c8-41ec-93a9-1ecb2abe3494","resolution":{"observed_at":"2026-07-31T14:32:40.739158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.758843Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.758843Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:a52f2f36456c92ce272133657384f1b53782e34a9fcb6d7458c3a029f169b9b8","observation_id":"ba6e802d-aed3-4323-98dd-1aedcaaaaf78","resolution":{"observed_at":"2026-07-31T14:32:40.758843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.677515Z","title":"InProceedings of the 2024 International Conference on Multimedia Retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.677515Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:729a28bef54e9abdb2186ce8c618ee2cd7e63a435843a6535404d6833689dc81","observation_id":"0f8bf93c-cedf-40fc-9e04-dac1850dbed1","resolution":{"observed_at":"2026-07-31T14:32:40.677515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-07-31T14:32:40.782089Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.782089Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:da30087815a9bffde050781ba3bc02980cbd2e6f35bba58fa4e85680dc2fe968","observation_id":"9a027000-0246-4575-a012-afb40a08f13a","resolution":{"observed_at":"2026-07-31T14:32:40.782089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.787362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.787362Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:4eda8ca5843f8e6bb5757c792925805c9eb9aadf0d99dd20bd3da3bd5c6381ca","observation_id":"667bb5c1-073c-48f1-bf30-47349078f263","resolution":{"observed_at":"2026-07-31T14:32:40.787362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01859","last_updated":"2023-11-01T18:43:34Z","snapshot_observed_at":"2026-08-13T10:20:30.002068Z","submitted_at":"2023-09-04T23:26:11Z","title":"NLLB-CLIP -- train performant multilingual image retrieval model on a budget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01859","snapshot_observed_at":"2026-07-31T14:32:40.798062Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.798062Z"},"links":{"cited_paper":"/paper/2309.01859","citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:9a579b9a0a3a92199494ed2fb971997414c2040b9d043b22314fff7020e0d72c","observation_id":"dcf2fa81-0db3-49c5-be59-2d5edf534902","resolution":{"observed_at":"2026-07-31T14:32:40.798062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.806653Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.806653Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:7cf7d70f86ec7b8faa239d6ef1247aa659a9690ba4e360225c39f3d3d022987c","observation_id":"3ac81adc-f838-4d2f-941c-04e830ab9c0e","resolution":{"observed_at":"2026-07-31T14:32:40.806653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.745595Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.745595Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:54863416a1694e5c01ce18d6b6c7782a8125b6e8a20cd3127a928e8bd99fa264","observation_id":"488fe49b-ad3f-4794-9ffc-b3cb4bc6ea21","resolution":{"observed_at":"2026-07-31T14:32:40.745595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.830045Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.830045Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:685f92d20203ecbda30b37fd8f4bc22548adb81fae52e6195f67f79a1d8a21cf","observation_id":"931d88ba-da3b-4f23-9dd9-e0bc7bc750ad","resolution":{"observed_at":"2026-07-31T14:32:40.830045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.766268Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.766268Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:4886a65f49b38935febb21b0b8fec57f61820b7e45cb643102bb4b99834088ec","observation_id":"e0761d98-5f30-491c-b76d-43f1cdc6a5c7","resolution":{"observed_at":"2026-07-31T14:32:40.766268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.773349Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.773349Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:2216be8ed7d170a4118da1a4b2d2717204df6ddc423dba0923c07e6d43b15ba8","observation_id":"a017b7d2-32e5-48e2-8a6c-6a0de7841e63","resolution":{"observed_at":"2026-07-31T14:32:40.773349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.857275Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.857275Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:fd01a76b046dedc2b17160828343fdbeccd89b398b2e7e7faa49087c4f6fe335","observation_id":"26880d3b-38bc-4b63-805f-8c9b63577ce5","resolution":{"observed_at":"2026-07-31T14:32:40.857275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.818478Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.818478Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:8be9f98409504a2cf34ebbb7df83060aac2eb67b6a8cd454fd1d71a295fbbeb1","observation_id":"ce95cfc2-52b3-4aaf-96d1-d3898273bf35","resolution":{"observed_at":"2026-07-31T14:32:40.818478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.837660Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.837660Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:734294d03a9cca61ba5e4fbd7884671bc94ce439ef42cfc0bb6ba18849cb3a58","observation_id":"a5c071f2-bc5b-4110-a5a9-a1f547a56bfe","resolution":{"observed_at":"2026-07-31T14:32:40.837660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.847223Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.847223Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:58660a050698429e40676d1d1717c4c370b7b1cb3bcb729d593fe65bb073dd05","observation_id":"857e4d56-9183-4c01-9514-a7c6a4903f6a","resolution":{"observed_at":"2026-07-31T14:32:40.847223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.578097Z","title":"InAdvances in Neural Information Processing Systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.578097Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:bfcd7c39607d9c7c4f74eb98268d0b7ca9757cd0b6a3d67bce2626afb4bb8fe2","observation_id":"c63a78c4-4940-486e-85be-a8137bf6f872","resolution":{"observed_at":"2026-07-31T14:32:40.578097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.372536Z","title":"InInternational Conference on Learning Representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.372536Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:a910495dd44ef6c496186674dacc372dfce85ba84cc0865d5c555e0ea4a156a1","observation_id":"4f2a2927-fb46-41e5-b63f-5d19a03803ea","resolution":{"observed_at":"2026-07-31T14:32:40.372536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.342760Z","title":"In Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.342760Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:b923ce28240a9462bfe3c04d95a6bc05185567f5e03f04e086addbf62f8ed6a5","observation_id":"d3df7928-5103-49d6-892c-86b190b32aac","resolution":{"observed_at":"2026-07-31T14:32:40.342760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.711574Z","title":"InProceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.711574Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:1f499fd4717ad427f40e69af0b765c2865affdf4877d36a172e6cdbe7e107ce8","observation_id":"44990ed6-754a-40b5-8eaa-622cc7b39b15","resolution":{"observed_at":"2026-07-31T14:32:40.711574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:32:40.440880Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.440880Z"},"links":{"citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:144cacffdced83394d788051ac66c4acac777f860b44e09f124d8f4be9438126","observation_id":"8b180af6-052e-463d-9117-0378e05bb106","resolution":{"observed_at":"2026-07-31T14:32:40.440880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2607.28211."}