{"as_of":"2026-08-08T09:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc3015ceeb800b6bc047cb704b7b36b15e2e9474f8c7e9e64095e5a98c616f13","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:48:33.976690Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07274/citation-record","integrity":"/paper/2507.07274/integrity","json":"/paper/2507.07274/citation-record.json","paper":"/paper/2507.07274"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:28.313729Z","title":"The multilingual mind: A survey of multilingual reasoning in language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.313729Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:87f1e1eae90ef339b5c85b5cb1adcb4b826a8fb65498cc1631de3db5ac9340fe","observation_id":"277c9638-a88a-4a02-87e7-9deb261c118b","resolution":{"observed_at":"2026-08-06T18:48:28.313729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16508","last_updated":"2025-05-01T03:41:42Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T15:44:42Z","title":"All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16508","snapshot_observed_at":"2026-08-06T18:48:28.390103Z","title":"All languages matter: Evaluating lmms on culturally diverse 100 languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.390103Z"},"links":{"cited_paper":"/paper/2411.16508","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:12a7ff2e4bcb0de44da9831bdd50eedaf557b8e28097789d7bea50aaa18adb88","observation_id":"8a75e55a-b008-4d3b-ab5f-4bb173f0d609","resolution":{"observed_at":"2026-08-06T18:48:28.390103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.769842Z","title":"VQA: Visual question answering,","venue":null,"work_id":"8126bb40-fec3-4b01-911b-281da18dda37","year":2015},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.536181Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:49997d3040ece947098f9685614dbecf76ddecb2a72f0fe0f31d7daff006e60d","observation_id":"c551ffdf-920a-4161-849c-5baf8f99d96f","resolution":{"observed_at":"2026-08-06T18:48:37.875503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.535540Z","title":"A-okvqa: A benchmark for visual question answering using world knowledge,","venue":null,"work_id":"5c6f0004-fcd1-482a-8a9e-769316b1e0db","year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.728590Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:49f83cccce4374b2effe194ee1bb4a98d8bb51d10bea25b96d59bebe9d6abdbf","observation_id":"929370b6-b0f7-4d9a-b377-fd99cf095e72","resolution":{"observed_at":"2026-08-06T18:48:37.669043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.342693Z","title":"Clevr: A diagnostic dataset for compositional language and elementary visual reasoning,","venue":null,"work_id":"f317209e-d188-4d0c-b2a7-216c0936c1d8","year":2016},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.912093Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:cd13ec52bbd1b75e626774c6e8db07ca5351fa0c18f9a49355d1afca983f7189","observation_id":"279c0d45-01b8-4d56-ad4e-8c6d8bfe1cdd","resolution":{"observed_at":"2026-08-06T18:48:37.443250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:29.118002Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.118002Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:d0590e30dee1c26fd473816190a81c6e30b08a21d5b5914487ce92f9876db3eb","observation_id":"5fa37962-cbec-4b83-88b5-d0861fca06e5","resolution":{"observed_at":"2026-08-06T18:48:29.118002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.090095Z","title":"From recognition to cognition: Visual commonsense reasoning,","venue":null,"work_id":"30685655-470e-4585-8cd9-ad8dedb24180","year":2019},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.289604Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:2cff593a0d5e7bff21cb909a8f282e2df190e245c334613fecd0a75e7bb07b6c","observation_id":"a7e782d7-faa7-460d-bf21-1d92d0e59f42","resolution":{"observed_at":"2026-08-06T18:48:37.183254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09095","last_updated":"2021-01-27T03:39:20Z","snapshot_observed_at":"2026-07-06T09:13:34.882593Z","submitted_at":"2020-04-20T07:19:22Z","title":"The State and Fate of Linguistic Diversity and Inclusion in the NLP World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09095","snapshot_observed_at":"2026-08-06T18:48:29.532259Z","title":"The state and fate of linguistic diversity and inclusion in the nlp world,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.532259Z"},"links":{"cited_paper":"/paper/2004.09095","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:53baa11fbe7f894112bc0ae8bdea746fa1e773995f335bca670a48583024dfa3","observation_id":"15c61380-9922-4123-9e5e-d741028ebd3e","resolution":{"observed_at":"2026-08-06T18:48:29.532259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-06T18:48:29.760086Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.760086Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:e7fb44cb2219f66acd412ec78e41f447340f92deef081e999bb6a180f73c416e","observation_id":"51094169-c967-4b44-a7fb-770020cd3348","resolution":{"observed_at":"2026-08-06T18:48:29.760086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09295","last_updated":"2025-06-04T07:53:00Z","snapshot_observed_at":"2026-08-02T01:50:49.249128Z","submitted_at":"2024-06-13T16:30:14Z","title":"AlignMMBench: Evaluating Chinese Multimodal Alignment in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09295","snapshot_observed_at":"2026-08-06T18:48:29.912325Z","title":"Alignmmbench: Evaluating chinese multimodal alignment in large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.912325Z"},"links":{"cited_paper":"/paper/2406.09295","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:bc4152d77ca672446f86323306c0d51dfc2d8c24e5d3ae08a07448eeda039cd1","observation_id":"50918f8a-5ef0-4397-819a-e86829ef4563","resolution":{"observed_at":"2026-08-06T18:48:29.912325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:36.822539Z","title":"Seed-bench: Benchmarking multimodal large language models,","venue":null,"work_id":"93923c66-9be0-475e-9272-87143185e117","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.108019Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:3b1ea0b8a687ba5b4bc5cc70edc3649d38e05965a9d18db084217c8dcf97b1b7","observation_id":"c3f09204-2769-4efa-899e-0c4db9ea4ec5","resolution":{"observed_at":"2026-08-06T18:48:36.936844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10378","last_updated":"2024-03-15T15:08:39Z","snapshot_observed_at":"2026-07-06T17:45:19.668165Z","submitted_at":"2024-03-15T15:08:39Z","title":"EXAMS-V: A Multi-Discipline Multilingual Multimodal Exam Benchmark for Evaluating Vision Language Models","version":1},"cited_work":{"arxiv_id":"2403.10378","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.10378","snapshot_observed_at":"2026-08-06T18:48:34.542416Z","title":"EXAMS-V: A Multi-Discipline Multilingual Multimodal Exam Benchmark for Evaluating Vision Language Models","venue":"cs.CL","work_id":"10f351f4-596f-4cb2-9faa-105461d88b9e","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.265910Z"},"links":{"cited_paper":"/paper/2403.10378","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:67c1cfa41f8fa4c35163bcd3f25225bd93cc97fb0be1f9e66a2acd8823ec5b40","observation_id":"63ac98c7-6851-4384-b7b9-b667751a7308","resolution":{"observed_at":"2026-08-06T18:48:34.631964Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12852","last_updated":"2025-02-18T13:40:05Z","snapshot_observed_at":"2026-08-07T18:08:48.348615Z","submitted_at":"2025-02-18T13:40:05Z","title":"MVL-SIB: A Massively Multilingual Vision-Language Benchmark for Cross-Modal Topical Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12852","snapshot_observed_at":"2026-08-06T18:48:30.486100Z","title":"Mvl-sib: A massively multilingual vision-language benchmark for cross-modal topical matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.486100Z"},"links":{"cited_paper":"/paper/2502.12852","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:936f4442a3a37dbba086686bb17f28feddde702c0ecf7f032bba905f6aedce74","observation_id":"7e1ac5e5-6ef0-4e24-b8ba-ba45e928ebd4","resolution":{"observed_at":"2026-08-06T18:48:30.486100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07346","last_updated":"2025-04-20T12:19:46Z","snapshot_observed_at":"2026-07-06T20:34:34.959285Z","submitted_at":"2025-02-11T08:17:19Z","title":"BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07346","snapshot_observed_at":"2026-08-06T18:48:30.633186Z","title":"Benchmax: A comprehensive multilingual evaluation suite for large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.633186Z"},"links":{"cited_paper":"/paper/2502.07346","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:5f5a5554a31b619c0089eb67a4531c42bdab87db0d816243317f8b2c01d746b4","observation_id":"2b3083bb-29df-47a1-8522-a90132a8fb6a","resolution":{"observed_at":"2026-08-06T18:48:30.633186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:36.584875Z","title":"Humanibench: A human-centric framework for large multimodal models evaluation,","venue":null,"work_id":"eaad4704-9f6a-45f2-a4ee-8269c94c2a8b","year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.840522Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:498adc2f6788b6cd37bd456f1377ab4b403b62d35b38593e635df29fe06047e0","observation_id":"0d53b239-64c7-46f8-a2f4-8e6176809506","resolution":{"observed_at":"2026-08-06T18:48:36.702934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:36.380197Z","title":"Multimodal large language models: A survey,","venue":null,"work_id":"0d04015f-4a5e-4c17-a63a-526894337acd","year":2023},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.046214Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:d3207806f3e1307170ef92354d0bf861b0296ab0d82f224ae45cb40f5a353203","observation_id":"62b2fd80-270e-4193-8b53-625b0e05961d","resolution":{"observed_at":"2026-08-06T18:48:36.463234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.06561","last_updated":"2021-07-08T13:56:05Z","snapshot_observed_at":"2026-07-06T10:48:55.513059Z","submitted_at":"2021-03-11T09:39:49Z","title":"WenLan: Bridging Vision and Language by Large-Scale Multi-Modal Pre-Training","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.06561","snapshot_observed_at":"2026-08-06T18:48:31.198006Z","title":"Wenlan: Bridging vision and language by large-scale multi-modal pre-training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.198006Z"},"links":{"cited_paper":"/paper/2103.06561","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:c91e0d61abf050b39b235e06c2e9a6e1fcdde25d5c0e3c9088464360fde1695c","observation_id":"ad48293e-7269-4dea-b663-5e103da3bdea","resolution":{"observed_at":"2026-08-06T18:48:31.198006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15562","last_updated":"2021-09-10T06:48:03Z","snapshot_observed_at":"2026-08-03T00:44:38.607700Z","submitted_at":"2020-12-31T11:37:28Z","title":"UNKs Everywhere: Adapting Multilingual Language Models to New Scripts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15562","snapshot_observed_at":"2026-08-06T18:48:31.347093Z","title":"Unks everywhere: Adapting multilingual language models to new scripts,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.347093Z"},"links":{"cited_paper":"/paper/2012.15562","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:9ac2707d578c31f7403afe0857bf52aeb7dab684058c1e6e89b0e5739b779603","observation_id":"7b16a71d-6410-4603-b61d-8ef28a8d5853","resolution":{"observed_at":"2026-08-06T18:48:31.347093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:36.146983Z","title":"Afriberta: Towards viable multilingual language models for low-resource languages,","venue":null,"work_id":"113c464b-dd3a-4fef-a4bb-fc84616eda46","year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.503521Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:772dcee09a585efe4309a43b6c8c1a0a5bc1a5fc9adb87fc6645ad4dda96e601","observation_id":"81a3cdb7-2380-4b82-9951-46950f8a72c6","resolution":{"observed_at":"2026-08-06T18:48:36.237205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.893472Z","title":"mgpt: Few-shot learners go multilingual,","venue":null,"work_id":"f182ce32-c23f-4031-b648-1320874b0f84","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.652320Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:d040208b0eeb04ecdb598229c20ca535d31985992eb5d2673facb10591d0e6d7","observation_id":"d9d8502c-ae0f-46f7-bd65-750a500d16f6","resolution":{"observed_at":"2026-08-06T18:48:36.028517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07412","last_updated":"2021-10-07T09:51:04Z","snapshot_observed_at":"2026-08-03T17:43:44.785835Z","submitted_at":"2021-04-15T12:26:12Z","title":"XTREME-R: Towards More Challenging and Nuanced Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2104.07412","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.07412","snapshot_observed_at":"2026-08-06T18:48:34.249311Z","title":"XTREME-R: Towards More Challenging and Nuanced Multilingual Evaluation","venue":"cs.CL","work_id":"34fda9ea-b07e-4abb-85a5-9e9eda0d54de","year":2021},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.805743Z"},"links":{"cited_paper":"/paper/2104.07412","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:dbcf8dd72b206631ba036c811f8f1be541cde15effc867c2f39d553d59fe1977","observation_id":"4b4ece51-957f-4b4f-aebf-f8ab015fc60d","resolution":{"observed_at":"2026-08-06T18:48:34.349496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-07-06T20:01:32.313250Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-06T18:48:31.924231Z","title":"Global mmlu: Understanding and addressing cultural and linguistic biases in multilingual evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.924231Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:a3864e98ba3bc403c8a0c524363efc7080f988f7b424068db9d79375ab49a568","observation_id":"97df9763-0cb6-4173-82f6-1a58a82dd509","resolution":{"observed_at":"2026-08-06T18:48:31.924231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-06T18:48:32.084674Z","title":"Massive: A 1m-example multilingual natural language understanding dataset with 51 typologically-diverse languages,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.084674Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:61a2da6856321ad09f0ba03d2327165dde370dd1db73df3993199adf4d6c73b7","observation_id":"c44afdc6-6ba8-410d-b38b-c7bc0dac977e","resolution":{"observed_at":"2026-08-06T18:48:32.084674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13707","last_updated":"2023-05-23T05:46:45Z","snapshot_observed_at":"2026-07-06T15:31:09.320113Z","submitted_at":"2023-05-23T05:46:45Z","title":"Do All Languages Cost the Same? Tokenization in the Era of Commercial Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13707","snapshot_observed_at":"2026-08-06T18:48:32.230138Z","title":"Do all languages cost the same? tokenization in the era of commercial language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.230138Z"},"links":{"cited_paper":"/paper/2305.13707","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:39efa1f0e9052f32ab0237c4f96b6a908fa02c80ce3ed426fe019f8cf0325f19","observation_id":"2e76ae1f-5719-4e86-980d-ff8d5620f2bf","resolution":{"observed_at":"2026-08-06T18:48:32.230138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.731149Z","title":"Parameter-efficient fine-tuning in large language models: a survey of methodologies,","venue":null,"work_id":"b59416b6-b43f-4578-b962-bfdf232b6f55","year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.433330Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:661f7e5d1a0ad9731dae241da544c77bc39aec1887522f4ed828342cc216ca73","observation_id":"3c6900d3-dca9-4623-ba67-affddec11ae2","resolution":{"observed_at":"2026-08-06T18:48:35.797361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.569551Z","title":"A review on fairness in machine learning,","venue":null,"work_id":"fff1629e-0030-43ae-8fd6-179e3963f93b","year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.589250Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:7db4e366b04291804b985284475f90355ce9f8949eee8099648c7e09dce53341","observation_id":"3a3271ef-5442-4a65-90a4-b237afed50c9","resolution":{"observed_at":"2026-08-06T18:48:35.640672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-06T18:48:32.730725Z","title":"Gemma 3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.730725Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:2d1355aa494381f3311190bdfb7ac5ab28250fd36706b1dfc2979ec4b982a82a","observation_id":"fd0a7165-9efb-49c7-9d8a-056d88e9b548","resolution":{"observed_at":"2026-08-06T18:48:32.730725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T18:48:32.885857Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.885857Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:52e24c05c27c249d3916a314c30ee1091954996dc7509fba8b1d65e5c5f6c2fc","observation_id":"7a09bfa7-79ce-44c4-a1aa-8db432405174","resolution":{"observed_at":"2026-08-06T18:48:32.885857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T18:48:33.031590Z","title":"Phi-4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.031590Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:8b91648250fd44056fbcea18f3bdf570229fbfece741b5adcdcaf856e64971bc","observation_id":"fc151baf-d6ea-45d1-a5f8-7f3a888f11ba","resolution":{"observed_at":"2026-08-06T18:48:33.031590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T18:48:33.174897Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.174897Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:b89f4b02463171ced98c689a275ee689ade190a4ffa46f97c92f851ef8766c51","observation_id":"ad2a30f7-53b3-495d-8165-c3099d406ff4","resolution":{"observed_at":"2026-08-06T18:48:33.174897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.398987Z","title":"GPT-4o System Card,","venue":null,"work_id":"fdcf41b5-3d85-4fe7-963d-78b3ecba8db4","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.376013Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:4d6de23ae59443dc4bb6ab20b2fdfd11683251d6c618385036d9e24043daea11","observation_id":"e3cf893e-f8fd-41ba-a380-45c3befcdc7f","resolution":{"observed_at":"2026-08-06T18:48:35.474644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.231306Z","title":"Gemini 2.0 Flash,","venue":null,"work_id":"cb96f08a-7df5-4092-9eb9-e8e7db720953","year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.532411Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:90bb8b9318246c3e0bae618c7012e3e0f80188c2c7795fe6e09c1a807ac9d223","observation_id":"c1f2bc30-1a1b-4b2e-a0b4-9a2a90ac7962","resolution":{"observed_at":"2026-08-06T18:48:35.306649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.013615Z","title":"Aya vision: Expanding the worlds ai can see,","venue":null,"work_id":"bd351d39-a153-4fe0-8f28-c5aa6fa95262","year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.719480Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:6d3729fb46693d9c595cb03598ec6324fcaf0d847d892e042674a25d0c2f89ed","observation_id":"b9938523-afee-4aa7-8a1f-c75efda0c47a","resolution":{"observed_at":"2026-08-06T18:48:35.127169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T18:48:33.851895Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.851895Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:afb1db9b7c71eb5949a0f76a3870052fa0294f5e0c4127206fed256b7d8b9dd7","observation_id":"8d0f73e4-1e86-497a-a4e2-4b586011f8e9","resolution":{"observed_at":"2026-08-06T18:48:33.851895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:34.839291Z","title":"Fair enough: Develop and assess a fair-compliant dataset for large language model training?,","venue":null,"work_id":"a3b93bbd-31c1-4ee1-a0c3-543ef8e88002","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.976690Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:9de8be68133d39db9ab917330b535ef68fee9066d16f002f1767ed2741f984ba","observation_id":"d96814f0-2dc5-4d6c-89b7-f4da3d6dc835","resolution":{"observed_at":"2026-08-06T18:48:34.920942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.07274."}