{"as_of":"2026-08-08T14:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab5fca7d7fe37c4847116f7e22a662e364fe61e8390554c7673d24bcc44e947a","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:36:10.316754Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20326/citation-record","integrity":"/paper/2505.20326/integrity","json":"/paper/2505.20326/citation-record.json","paper":"/paper/2505.20326"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.945902Z","title":"See it from my perspective: How language affects cultural bias in image understanding","venue":null,"work_id":"00d93d12-603b-4eb6-a985-edaf57f9dd92","year":null},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:07.947602Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:70edddbea758abdabfc41984334be5875428034ddf0784b6eec643e03f62e612","observation_id":"b4c60a33-7f56-4687-9741-3da9ceba5bc4","resolution":{"observed_at":"2026-08-07T14:36:14.010711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.744101Z","title":"From local concepts to universals: Evaluating the multicultural understanding of vision-language models","venue":null,"work_id":"5dcb8721-6cc6-47b2-8572-5846c778c61e","year":2024},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.069947Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:f194ebbf23a39837d5406dba263d280122adc01bdb4c26f40dbff05a92577dcb","observation_id":"f2ee2149-dd70-43c6-912f-65f7ba6ec18c","resolution":{"observed_at":"2026-08-07T14:36:13.866511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.01963","last_updated":"2021-10-05T11:47:27Z","snapshot_observed_at":"2026-07-06T11:54:31.182477Z","submitted_at":"2021-10-05T11:47:27Z","title":"Multimodal datasets: misogyny, pornography, and malignant stereotypes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.01963","snapshot_observed_at":"2026-08-07T14:36:08.190528Z","title":"Multimodal datasets: misogyny, pornog- raphy, and malignant stereotypes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.190528Z"},"links":{"cited_paper":"/paper/2110.01963","citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:8fe4f099768bd3cf8f69ce0578bbc654b988aec8950fc2cc0ab08044529d5466","observation_id":"672c9ce1-be5e-4c62-91f4-05776827600b","resolution":{"observed_at":"2026-08-07T14:36:08.190528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.635848Z","title":"Reproducible scaling laws for contrastive language-image learning","venue":null,"work_id":"32ddfb1a-1796-40f6-8769-9f3a08ab707d","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.347830Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:ce8c665223bb56f16f8140d8ac9da770d9de68b370db1a4dbb2681b406998035","observation_id":"0fbfc8cb-a62e-411d-9732-de5a978ad00d","resolution":{"observed_at":"2026-08-07T14:36:13.689491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.517494Z","title":"Improving clip training with language rewrites","venue":null,"work_id":"2be006ea-60eb-4687-9298-1ae47846acc9","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.451457Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:3bdb0658cf517d4baedf535d225257711d92e02518ea97d858628cad8aa57c69","observation_id":"aba5acc2-313e-4d58-ad3d-e986de495b8d","resolution":{"observed_at":"2026-08-07T14:36:13.575096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.322816Z","title":"Uncurated image-text datasets: Shedding light on demographic bias","venue":null,"work_id":"d4c15e97-4311-4c1d-ade8-8c8f9f1463e2","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.578379Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:58e938173a7c1d997ff6854dbf6f927bba7c645759573a2653c7e8049eff6661","observation_id":"875c2967-d629-41ed-bd75-fcf873b27611","resolution":{"observed_at":"2026-08-07T14:36:13.429559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11100","last_updated":"2023-01-26T13:44:31Z","snapshot_observed_at":"2026-08-04T12:33:42.854725Z","submitted_at":"2023-01-26T13:44:31Z","title":"Vision-Language Models Performing Zero-Shot Tasks Exhibit Gender-based Disparities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11100","snapshot_observed_at":"2026-08-07T14:36:08.709859Z","title":"Vision-language models per- forming zero-shot tasks exhibit gender-based disparities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.709859Z"},"links":{"cited_paper":"/paper/2301.11100","citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:1997ce7cbf032f3aa1163635969dae1a1323eda5d4b34b5fc3256fbf22f3b32b","observation_id":"49dff444-765f-485c-b439-18341c3c9e9a","resolution":{"observed_at":"2026-08-07T14:36:08.709859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.180293Z","title":"So- cialcounterfactuals: Probing and mitigating intersectional social biases in vision-language models with counterfac- tual examples","venue":null,"work_id":"7936d9c4-e680-459e-90bb-735ab33a087a","year":2024},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.827202Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:d428999b9202e3a6c23d3799426f4b67d38ac893fc89c901d5f96ba6e1f1485f","observation_id":"a93a818f-9e02-4233-ada9-f29db1604257","resolution":{"observed_at":"2026-08-07T14:36:13.255658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.002421Z","title":"Multi-modal bias: Introducing a framework for stereotypical bias as- sessment beyond gender and race in vision–language models","venue":null,"work_id":"d6a2859b-6795-4215-8b1a-54666bb136a6","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.971057Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:8f8668b4040659393aca02a591810dd2d3b321a821038655b56b90325cb2be59","observation_id":"6ae4aef5-1ad9-429d-98df-d3474c6356a9","resolution":{"observed_at":"2026-08-07T14:36:13.078675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.857785Z","title":"Fairface: Face attribute dataset for balanced race, gender, and age for bias measurement and mitigation","venue":null,"work_id":"3f018415-5739-4eb6-9a5c-4a5ff22ae5b3","year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.074492Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:cd73f393ef49555be3651b0063b11850f4c152cbef216ab9439186cc32829f6a","observation_id":"66a858ac-b506-4da0-89a3-ef8ecfaab1eb","resolution":{"observed_at":"2026-08-07T14:36:12.916295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.698919Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"98da908f-aeff-40cc-8851-afb432d7cba6","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.170988Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:8b507c94bd8f2cb234f6b77e8d7ba2ca6b0b6f6cb7ceaf04b92fa292b5dfe01e","observation_id":"a99deb3b-dc10-4aab-9199-b8c9fc650123","resolution":{"observed_at":"2026-08-07T14:36:12.778598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.542872Z","title":"Visually grounded reasoning across languages and cultures","venue":null,"work_id":"485a2f54-ee62-4681-8dd9-6f3732b70695","year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.257226Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:25bc0bf006585ad381316517bf9e95fc19c90415be5b0fdd928a98ee64e382bb","observation_id":"bd59e4a6-5791-4817-9caf-8cebb9cb6e12","resolution":{"observed_at":"2026-08-07T14:36:12.622095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.313922Z","title":"Stable bias: Evaluating societal rep- resentations in diffusion models","venue":null,"work_id":"3535423f-ec3b-4338-bd8f-0ac7836ce7af","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.356163Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:2cd5b4ea9b32c12a127aa13453f6d6cd23e00ccc8709e54d1d4a19e5f4d38f13","observation_id":"09bf5613-7cf8-4fc2-87ab-809f4086dbce","resolution":{"observed_at":"2026-08-07T14:36:12.442475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.121631Z","title":"Benchmarking vision language models for cultural understanding","venue":null,"work_id":"fd819be1-93fe-4567-8fe0-ec44602d7633","year":2024},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.429879Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:8fa9c25d2bae32245ddf6bf84834ed937e49c848bc490a6349c49d6a06bc36f0","observation_id":"93b2f634-8e35-4eb9-8fdc-6228ed4275ca","resolution":{"observed_at":"2026-08-07T14:36:12.205596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.938428Z","title":"Bridging the digital divide: Performance variation across socio- economic factors in vision-language models","venue":null,"work_id":"a8d25fc2-827d-4c15-860d-e9877e02ef98","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.495642Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:89e80c90a19827d629c802ab7ec5f8444e07e27e4fed008a177bff09187c5f29","observation_id":"41aee9e0-fa81-4a31-89e0-307cabb2db91","resolution":{"observed_at":"2026-08-07T14:36:12.034537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.830737Z","title":"No filter: Cultural and socioe- conomic diversity in contrastive vision-language models","venue":null,"work_id":"c692bade-2ea0-4e44-aa10-1bec3d90e15c","year":2024},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.622623Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:a95cc6203f3d6e25f5ec2be738a4d44a4afb91e2fb8360741cfd86568af82d6a","observation_id":"27a485d5-36fe-4aaa-b178-73cc59c9cb77","resolution":{"observed_at":"2026-08-07T14:36:11.881040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.698279Z","title":"Learn- ing transferable visual models from natural language su- pervision","venue":null,"work_id":"2bc02351-fee8-4309-b5d2-c5f6fcaa7abd","year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.746770Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:affff830e8e54162a2759459e8f36b36f4aa76e6498ec951f46a96eca3f63542","observation_id":"863fa5a8-08ff-407a-b40a-991eebaf593d","resolution":{"observed_at":"2026-08-07T14:36:11.790036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.474412Z","title":"No classification without representation: Assessing geodiversity issues in open data sets for the developing world","venue":null,"work_id":"3464d98b-34d4-4031-8983-638b7d53e151","year":null},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.855946Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:06b4c2f7439380b8604419a12937830979d632fa81782675d64616982f8b1ddc","observation_id":"8062d537-4532-4e6a-9aae-1a40e44f497c","resolution":{"observed_at":"2026-08-07T14:36:11.565500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.356468Z","title":"Flava: A foundational language and vision alignment model","venue":null,"work_id":"9c3fd0a7-6879-4d28-ba5d-5eab3fb14fef","year":2022},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.944434Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:894d2ae6a3c2ff19f031283265ca86c5d048235e56573bac4f2a2d83276f02a8","observation_id":"618a87bd-bf6b-4019-8fb3-8b327c68a165","resolution":{"observed_at":"2026-08-07T14:36:11.402018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.160985Z","title":"Alip: Adaptive language-image pre-training with synthetic cap- tion","venue":null,"work_id":"6372c5f1-ef43-41b2-bd10-c7a71856070e","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.007745Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:7099f313ba7e9907f58b9063eaac934fb74f60e4bf8bd6f5b67dffe4aaee5967","observation_id":"e0fefdb2-cd97-43fb-9550-7ac6a37fb2be","resolution":{"observed_at":"2026-08-07T14:36:11.285790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:10.970265Z","title":"Sigmoid loss for language image pre- training","venue":null,"work_id":"9c82453d-e721-48b1-bdc1-e8caab50c537","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.054381Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:200699fc693c8a2f692746e9b09ee13156dce2f75c7fe90c66219f7a35915a58","observation_id":"9524fd64-c689-4cba-a25d-c17c2e2b02cb","resolution":{"observed_at":"2026-08-07T14:36:11.068510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:10.804367Z","title":"Un- derstanding and evaluating racial biases in image cap- tioning","venue":null,"work_id":"02074a87-f030-4f29-862a-102026fc1e7d","year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.123995Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:2cd2cb28a0d70b66cba8dd27d45e976970175dda537e25c76455fc3520479581","observation_id":"44745be6-ea90-4bd3-8361-4d68574a849a","resolution":{"observed_at":"2026-08-07T14:36:10.907644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:10.644897Z","title":"Vlstereoset: A study of stereotypical bias in pre-trained vision-language models","venue":null,"work_id":"f414aba9-1310-42ed-b5ee-89a7bf202f0c","year":2022},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.225139Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:f27c01a4546a6d1e3eb608413140f87dee2e09715b53938b6df1a240696b11cc","observation_id":"4e4235ff-6de7-4f05-bebb-aa905c4edfa6","resolution":{"observed_at":"2026-08-07T14:36:10.738277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:10.456787Z","title":null,"venue":null,"work_id":"be3a4d2d-6899-44d6-9c57-7eb8227defc4","year":null},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.316754Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:79417a702a8d15392652ef1c744c3514b59867e2ae2fc03e49aae272a41a91f8","observation_id":"66a0e14e-41df-46b5-ae18-8e3a047ed7a5","resolution":{"observed_at":"2026-08-07T14:36:10.533939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2505.20326."}