{"as_of":"2026-08-10T20:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:870e88215d79e9cfbad9ac9af559682cddab9da05531a61f5d656f8db845f6c5","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:21:31.476211Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T03:00:51.318412Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11114","snapshot_observed_at":"2026-07-13T03:00:51.318412Z","title":"Ahmed, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09438","last_updated":"2026-07-10T14:09:04Z","snapshot_observed_at":"2026-08-06T13:00:09.267598Z","submitted_at":"2026-07-10T14:09:04Z","title":"Test-Time Scaling for Small VLMs on Multilingual Visual MCQ","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T03:00:51.318412Z"},"links":{"cited_paper":"/paper/2507.11114","citing_paper":"/paper/2607.09438"},"observation_digest":"sha256:55ae6db8363afade0b444589c249db4826611410fdb9c14184efa696f88ba38a","observation_id":"cf2ba68c-894c-4090-8107-87739cb3a732","resolution":{"observed_at":"2026-07-13T03:00:51.318412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.11114/citation-record","integrity":"/paper/2507.11114/integrity","json":"/paper/2507.11114/citation-record.json","paper":"/paper/2507.11114"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.901140Z","title":"Zhang, J","venue":null,"work_id":"c6e70258-14ce-4668-8d2d-27f5a09fd8d8","year":2024},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.393362Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:76ab28f379c4d1b32212f7f568febf47e01c52bdf2809c2ec57ded30d420fb59","observation_id":"92470eb8-9efe-42d2-9980-248036356263","resolution":{"observed_at":"2026-08-06T17:21:31.905378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-06T17:21:31.404396Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.404396Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:efbe70847f7d0a74191805c91b375647b8a9ff8d337c9dbe4792625575059011","observation_id":"f0ebc0d1-93a4-4554-b8ad-342654e74dde","resolution":{"observed_at":"2026-08-06T17:21:31.404396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.408964Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.408964Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:cad9b564a74e7e48c64fb9eb9de7a7bd499070526ce5eca5b926e733e74130ec","observation_id":"0c1a05da-e30b-42c1-a013-8bcd0f13e334","resolution":{"observed_at":"2026-08-06T17:21:31.408964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.891154Z","title":null,"venue":null,"work_id":"1bcc4e38-42dc-4362-92e4-080d7d61dd96","year":2022},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.414629Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:c55b3fcd268d5b8d44db89d3cb5cb6bf005dad13284a67bef28fdcbce122d728","observation_id":"3ad7f9ac-8795-4f5d-95a6-fbdb1fba706a","resolution":{"observed_at":"2026-08-06T17:21:31.894357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.880405Z","title":"Huang, et al., M3exam: A multilingual, multimodal, multilevel benchmark for examining large language models, in: NeurIPS Datasets and Benchmarks Track, 2023","venue":null,"work_id":"44102f7d-3f87-45ca-ae86-e72783ef6653","year":2023},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.421210Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:57e02422ee6f4fd39a2eef7bde40938734e45f4f7fbcb93015bf1758b0366ff6","observation_id":"a6f10935-7194-4020-a331-c6cc9f155762","resolution":{"observed_at":"2026-08-06T17:21:31.884289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.18484","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.705220Z","title":null,"venue":null,"work_id":"e5b1257f-468b-490a-b7d2-763a8cd16f24","year":2025},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.424431Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:c76ec4b20b08325689b68b3432149f35d132c247d3f60f83928a12c878a6cb67","observation_id":"4ca57af0-7765-4b7d-88df-1aa8fe32a921","resolution":{"observed_at":"2026-08-06T17:21:31.710786Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.870004Z","title":"Dimitrov, M","venue":null,"work_id":"1fb66b98-c8b4-445d-a5ab-59d84de6348b","year":2025},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.427692Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:44108278986b9f83b57444655226e72915bc093ce7320069b4be79359d2be1a0","observation_id":"5c6d92af-a4f8-4e0d-9de5-f11ea9f2a027","resolution":{"observed_at":"2026-08-06T17:21:31.873465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.859789Z","title":"Ionescu, H","venue":null,"work_id":"d4068e76-ff39-4bef-9273-62c32e63e55f","year":2025},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.437470Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:07f0914f1b68278d31bbacb8c5dec8af74645e4b6751512b5cb555e4bd56b8fc","observation_id":"f8bdb6af-5c30-4b2d-862e-2737345e9e68","resolution":{"observed_at":"2026-08-06T17:21:31.863199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15638","last_updated":"2025-04-25T04:37:45Z","snapshot_observed_at":"2026-08-02T17:53:33.386720Z","submitted_at":"2024-05-24T15:25:28Z","title":"M4U: Evaluating Multilingual Understanding and Reasoning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15638","snapshot_observed_at":"2026-08-06T17:21:31.440457Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.440457Z"},"links":{"cited_paper":"/paper/2405.15638","citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:f480bc2582ab96bebe364b81df5f4f71696ea9fb5d7535ac4fff8e547444f7bc","observation_id":"a7672fc2-0c8b-453f-821f-56b28ce2e13a","resolution":{"observed_at":"2026-08-06T17:21:31.440457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.849916Z","title":"Zhang, M","venue":null,"work_id":"52054350-a2cd-4347-85b6-f1afbc8b31ec","year":2023},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.444814Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:011127cdc3273bc1b1194091fd7f469b35cd6f02bba71786a8fe5ca0992d97ee","observation_id":"ac521802-bc06-497e-8b97-05af889726f3","resolution":{"observed_at":"2026-08-06T17:21:31.853022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-06T17:21:31.452850Z","title":"Zhou, et al., Language models are multilingual chain-of-thought reasoners, arXiv preprint arXiv:2210.03057 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.452850Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:8886d1b79c0f4252780d586a4e99d1ef318ef8341ffcd1e09eef1192b85ee076","observation_id":"55962e93-2d13-45da-866e-11bf31b14607","resolution":{"observed_at":"2026-08-06T17:21:31.452850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.455296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.455296Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:e12e04ebc6acd3579cf478af2585e1f944e43665b10a937041ec818d58809de6","observation_id":"3c67d9fd-629d-4a86-8262-13bf014a3514","resolution":{"observed_at":"2026-08-06T17:21:31.455296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.838147Z","title":null,"venue":null,"work_id":"145b9952-866d-4a7d-904c-a6f4bcc854e8","year":2022},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.458593Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:fffde365c4ac50a37b8387e497acba89b27f0e7058c9e3aa500196aff552ed8c","observation_id":"3d562751-8eec-4e9d-b3d0-72c93878a930","resolution":{"observed_at":"2026-08-06T17:21:31.841294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.828870Z","title":"Accessed: 2025-03-15","venue":null,"work_id":"741e31b7-8a9b-438c-9b3e-07296a12bbd8","year":2025},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.461180Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:2e5aa1fc37f5cbf06310a2714a7e7c23066d24118e6fdb2fb5b7699aef124f0b","observation_id":"43f61f8a-3aa4-4aee-b567-374803ebd6ff","resolution":{"observed_at":"2026-08-06T17:21:31.831966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.817403Z","title":"Accessed: 2025-01-10","venue":null,"work_id":"78c192bc-e58b-4bf6-b84b-4cf4df930ef7","year":2024},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.463774Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:3b1a55a516be242126848191f75b998c516c052a6e4a36923110d2d5ccd219f9","observation_id":"63caafe2-1361-4995-9fad-3dbb5499b695","resolution":{"observed_at":"2026-08-06T17:21:31.820829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.806495Z","title":"Accessed: 2025-05-28","venue":null,"work_id":"0c944cb8-d900-4f29-9b86-0d364d22e8da","year":2025},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.466903Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:21738fe3732ecd67066e5fbcd3598d8a088afe5c7b98ca2a6c2c25124a594522","observation_id":"0f126019-ecbf-4787-b9d4-364c8322d39f","resolution":{"observed_at":"2026-08-06T17:21:31.810382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T17:21:31.469737Z","title":"Accessed: 2024-12-15","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.469737Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:0f5887a0e824b79c27a628194167cea8d64c720c36bd266fdc5d6e35976ca135","observation_id":"c849ec16-283d-49a4-8dfc-a9fb5dc2b533","resolution":{"observed_at":"2026-08-06T17:21:31.469737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:31.796710Z","title":"DeepMind, Gemma Team, Gemma 3: Advancing open language models, https://blog.google/ technology/developers/gemma-3-google-new-open-model/, 2024","venue":null,"work_id":"d4fc27de-4403-4a63-b1a6-d9e91cc1f6e7","year":2024},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.473297Z"},"links":{"citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:71d476595e316edcd7b61e9d761fed6e06c6a019ddcf7715da5d057eff371358","observation_id":"58cbb8ad-5ddf-4a5b-ba60-a8177482ab0d","resolution":{"observed_at":"2026-08-06T17:21:31.800766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T17:21:31.476211Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:31.476211Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.11114"},"observation_digest":"sha256:52451122c04c3ec3f83ab62f644e807847a373a72e02deb7be993b3dbe84bb5c","observation_id":"aea30014-7dc6-4b96-9110-31fe232355ff","resolution":{"observed_at":"2026-08-06T17:21:31.476211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.11114","last_updated":"2025-07-15T09:05:05Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T22:23:37.043249Z","submitted_at":"2025-07-15T09:05:05Z","title":"MSA at ImageCLEF 2025 Multimodal Reasoning: Multilingual Multimodal Reasoning With Ensemble Vision Language Models"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 1 inbound Pith citation observation for arXiv:2507.11114."}