{"as_of":"2026-08-08T03:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61d398088ba35f69919d918cb4e73797206158f863d43c2cfc0a0366474232b7","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:39:00.747897Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07418/citation-record","integrity":"/paper/2506.07418/integrity","json":"/paper/2506.07418/citation-record.json","paper":"/paper/2506.07418"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:06.430977Z","title":"Zhang, Y","venue":null,"work_id":"6e0a011d-d068-45f4-a236-660b9fdc35f6","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:56.536458Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:3f23e3b0c71f4bb37e278395193fb12cfd2523f7f57820b9d8fbe415ab42304d","observation_id":"a484e773-47e5-42ae-b5d5-8fb790abd933","resolution":{"observed_at":"2026-08-07T05:39:06.503087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:06.184367Z","title":"Achiam, S","venue":null,"work_id":"89265f57-724f-495d-844e-f4e7958337d9","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:56.650734Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:7b060e22d4e7b2839ee0596b28cb390e074fa9739d393fe9d52df8b551e6b6c7","observation_id":"3aae2431-7507-489e-bea7-b08a9baa8cb8","resolution":{"observed_at":"2026-08-07T05:39:06.313361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:05.994722Z","title":"Qwen2.5-vl 7b.GitHub Repository, 2024","venue":null,"work_id":"babd8c79-1500-4ab2-a7e6-308b703471da","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:56.737402Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:3aa733a4f8243ce6dd875f0918b5e353fc8bc708b3a86022865752c6d903dffe","observation_id":"fc18f617-188d-4cea-a35f-ca373b0d3f75","resolution":{"observed_at":"2026-08-07T05:39:06.069406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T05:38:56.825172Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:56.825172Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:7ebae5677ff89d4d761e37227246bf0d1bce1c73ebd571d7533ab928cdca1f11","observation_id":"42929a52-a881-4b7b-bc17-e02c0c02a3e4","resolution":{"observed_at":"2026-08-07T05:38:56.825172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:05.829982Z","title":"Andreescu and R","venue":null,"work_id":"485a2f96-ab9a-4242-a805-4cc6769f67cd","year":2008},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:56.904032Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:ed133d893a7b1cb78d68aba2682e93f4108acc09a1670804083d7082f68d264b","observation_id":"2630dfda-3d82-47c3-8b56-eef2f69ea43e","resolution":{"observed_at":"2026-08-07T05:39:05.898084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08632","last_updated":"2024-09-06T11:20:13Z","snapshot_observed_at":"2026-07-06T19:01:27.827878Z","submitted_at":"2024-08-16T09:52:02Z","title":"A Survey on Benchmarks of Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08632","snapshot_observed_at":"2026-08-07T05:38:57.018980Z","title":"Li and W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.018980Z"},"links":{"cited_paper":"/paper/2408.08632","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:a01a057e42687aec8e2f5b716b2bd2935deb7f649b2e0695788dcd02ed0b3fd8","observation_id":"93700d1e-7cf0-4a5d-8199-fbe04144cfe1","resolution":{"observed_at":"2026-08-07T05:38:57.018980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00147","last_updated":"2024-08-30T07:37:38Z","snapshot_observed_at":"2026-07-06T19:08:26.637143Z","submitted_at":"2024-08-30T07:37:38Z","title":"MultiMath: Bridging Visual and Mathematical Reasoning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00147","snapshot_observed_at":"2026-08-07T05:38:57.150799Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.150799Z"},"links":{"cited_paper":"/paper/2409.00147","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:b88eadd2053b242ab63534368919f0fefcd0e6308a43f9aa593a531586183359","observation_id":"50ca7b15-dfdc-46db-8798-0ddf1a0e0329","resolution":{"observed_at":"2026-08-07T05:38:57.150799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T05:38:57.238958Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.238958Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:4b2275277de415d8f9ccd75d810b95ec3521d80537292aac12e2272851acfd26","observation_id":"87b1b2c3-68b9-4d65-afbc-738f1b3f6947","resolution":{"observed_at":"2026-08-07T05:38:57.238958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:05.616972Z","title":null,"venue":null,"work_id":"10a13ddd-71a6-48a8-9ca3-a49604cd3715","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.326879Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:1de9e431a8771d803159c6dd5842d52e0829d7a5e279652de9a2d93bec728e02","observation_id":"cad49236-1d9d-49f3-9a3f-c38b95ef13a2","resolution":{"observed_at":"2026-08-07T05:39:05.722951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11370","last_updated":"2025-08-20T15:45:11Z","snapshot_observed_at":"2026-08-02T03:18:39.824103Z","submitted_at":"2023-12-18T17:36:20Z","title":"G-LLaVA: Solving Geometric Problem with Multi-Modal Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11370","snapshot_observed_at":"2026-08-07T05:38:57.399389Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.399389Z"},"links":{"cited_paper":"/paper/2312.11370","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:bd79e41f58b794721e3a493a1189ef3607a2dab3dfd44baea3adc9a86a9ff217","observation_id":"304fed1b-577f-4a56-9216-74a69416e9ca","resolution":{"observed_at":"2026-08-07T05:38:57.399389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:05.394864Z","title":"Shindo, V","venue":null,"work_id":"ec86aa1b-9c11-401b-a1a6-489d896bc873","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.478028Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:2c90ca0fde5433bec7e2d6c2e7cc416fdceb3e72944b3c8b0b62d9cca2131285","observation_id":"5138c6dd-79fd-47d8-89ba-261db7c90624","resolution":{"observed_at":"2026-08-07T05:39:05.485076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:05.203011Z","title":"Kangaroo Mathematics Competition, 2025","venue":null,"work_id":"201bc175-e44e-413d-8dd5-aff7e90eded9","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.585502Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:315c8c6141a854ddd970e7ffcd6d417655c2c23a99dde360d67d14e58c276fd7","observation_id":"caf37e07-1b82-4459-a02c-4927935021c0","resolution":{"observed_at":"2026-08-07T05:39:05.273555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:05.044118Z","title":null,"venue":null,"work_id":"cc43d44a-48f7-4624-970a-ac9a599f81f2","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.678482Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:158bb79a60261e82ad61f671b13d5523e7f7b4fe536d5b12183c78c9a4d5280c","observation_id":"cb88a8b8-03b8-4266-8d7e-738e2c7f8f5b","resolution":{"observed_at":"2026-08-07T05:39:05.148045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:04.839204Z","title":"Rhomrasi, Y","venue":null,"work_id":"6cd71068-fb7e-4b51-8f91-e965c93505f3","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.785035Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:f648768fe61d3ae132a02f08e0a0a1bc026e986ab334dac68a111a8c3427659f","observation_id":"573b588d-a2f9-42f0-9b3f-f827c66c52d0","resolution":{"observed_at":"2026-08-07T05:39:04.938401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:04.666267Z","title":null,"venue":null,"work_id":"6ac280a2-c76f-4196-a9db-1940950e8879","year":2015},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:57.900519Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:c3e45a4feb607f9f674be1a8f7ff4fa137a9336bc48a4a6b38d7f9dd7b4519b1","observation_id":"d745f0ea-b10e-4459-9681-3fd338604861","resolution":{"observed_at":"2026-08-07T05:39:04.752925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:04.461981Z","title":"Sachan and E","venue":null,"work_id":"ab83d66c-3ee2-41d5-8dbc-6759c3c629ac","year":2017},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.004348Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:2c2a05ac357368b03493468ecb3c517ce59700e44f15b114880488ad5fdd2c2b","observation_id":"2d0e39b0-00e1-4238-ba58-8e2830ac619f","resolution":{"observed_at":"2026-08-07T05:39:04.548848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:04.308147Z","title":"Alayrac, J","venue":null,"work_id":"4e089677-3783-40e6-a8c5-a11ff598720c","year":2022},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.123777Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:537739ef7015a19f3e1777d092253264ae97489bc4f80d72a417455a6336f125","observation_id":"c3b793c7-6a0e-4711-ade6-818b4fb0e3c2","resolution":{"observed_at":"2026-08-07T05:39:04.364881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:04.109548Z","title":"Antol, A","venue":null,"work_id":"51566ae0-5a2b-446a-be26-25bd91aba8a8","year":2015},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.228933Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:364666d340afbc6ef6752de8162535eb8778a130f34c37c731c7fb1a3523de2d","observation_id":"66b9ed53-75f3-4785-ad3e-e3e9985d2472","resolution":{"observed_at":"2026-08-07T05:39:04.200993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04165","last_updated":"2021-07-20T23:22:27Z","snapshot_observed_at":"2026-08-06T13:29:31.050456Z","submitted_at":"2021-05-10T07:46:55Z","title":"Inter-GPS: Interpretable Geometry Problem Solving with Formal Language and Symbolic Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04165","snapshot_observed_at":"2026-08-07T05:38:58.315986Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.315986Z"},"links":{"cited_paper":"/paper/2105.04165","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:325ff824ee8eee529992af4d9ddabaf610802f4527ab6d6c891dfbf58d1b788a","observation_id":"1b2bac11-e557-41de-90d9-0663e5af949e","resolution":{"observed_at":"2026-08-07T05:38:58.315986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-07T05:38:58.407354Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.407354Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:b658d9f331d073d1cd8664cb6001f133ca0f9822d04ee3ae759072a8057360af","observation_id":"c7c7c834-d8c3-4486-a128-551a39b058d1","resolution":{"observed_at":"2026-08-07T05:38:58.407354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:03.960136Z","title":"Zhang, D","venue":null,"work_id":"41f1a5d7-b98d-439c-9e5d-ae1cb42a0d29","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.556096Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:4ae52271961f7c683589ba4150caaf4aebd29953a3383185348caa8a7444cd6c","observation_id":"95d62a69-1cec-46fb-91d8-974add5e83dc","resolution":{"observed_at":"2026-08-07T05:39:04.016375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01777","last_updated":"2025-08-27T05:37:31Z","snapshot_observed_at":"2026-08-03T12:09:43.800452Z","submitted_at":"2024-03-04T07:10:31Z","title":"NPHardEval4V: Dynamic Evaluation of Large Vision-Language Models with Effects of Vision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01777","snapshot_observed_at":"2026-08-07T05:38:58.647891Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.647891Z"},"links":{"cited_paper":"/paper/2403.01777","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:9dc80e8870a2773594115341701cb23a7ff66629fdbc54d96090f6246a6ed706","observation_id":"97d54cd4-ff90-40b7-93e9-00ce9a5c2f64","resolution":{"observed_at":"2026-08-07T05:38:58.647891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08733","last_updated":"2024-10-08T10:51:59Z","snapshot_observed_at":"2026-08-03T15:30:28.663561Z","submitted_at":"2024-07-11T17:58:58Z","title":"Is Your Model Really A Good Math Reasoner? Evaluating Mathematical Reasoning with Checklist","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08733","snapshot_observed_at":"2026-08-07T05:38:58.780594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.780594Z"},"links":{"cited_paper":"/paper/2407.08733","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:7e01a6f3e9b9d36dcc833d6c1d1530d30adc6f29bf607051c74c59ea5aa5644b","observation_id":"af557481-fa63-43f1-bd55-bc3fbec83de0","resolution":{"observed_at":"2026-08-07T05:38:58.780594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:03.757864Z","title":"Goyal, T","venue":null,"work_id":"390871dc-6e45-482f-8455-8def191e73f6","year":2017},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.862704Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:76d8c81567603be2b9f1f14bd043f1c60771917ced56846455bef3926668fe14","observation_id":"5f2f6cf7-204e-4d06-8cb0-e32ee99c223a","resolution":{"observed_at":"2026-08-07T05:39:03.831158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-07T05:38:58.990977Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:58.990977Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:6d9d0b38440e70ba82028b2df39c479e18f33a969b7583dc96733c0231fcac08","observation_id":"453f1ba5-a98e-4c99-b932-26767347630a","resolution":{"observed_at":"2026-08-07T05:38:58.990977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:03.578156Z","title":"Saikh, T","venue":null,"work_id":"75c0b9ea-3865-4448-ad92-de39afd7c7a9","year":2022},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.074449Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:774bac676aadf437420dcfdfc180f762ef552dc5f2aa687f32b3c983f7d95ede","observation_id":"ee210642-10fa-4f89-8037-d4ece739fa93","resolution":{"observed_at":"2026-08-07T05:39:03.637710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:03.418683Z","title":"Caffagni, F","venue":null,"work_id":"5dc682b9-dbf5-4326-bcf9-a2da1f34b587","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.168749Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:9cc9174eaa495c71d089a82b15fb24b3b6601fb4eb12b81129fc72a8ed645f38","observation_id":"0c87dee2-7f1b-42df-a252-7f049e8e7e4f","resolution":{"observed_at":"2026-08-07T05:39:03.476997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:03.294534Z","title":null,"venue":null,"work_id":"bcaea5e9-bbbb-429d-9a46-ffbf34ec24a9","year":2022},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.258951Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:099756abdb928d8c786a9e36f277f2bcfcf892377be6e57acec4d4132c9cd7d6","observation_id":"896556e9-dafe-4f9a-a901-4e5005ad5654","resolution":{"observed_at":"2026-08-07T05:39:03.348832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T05:38:59.377109Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.arXiv preprint, arXiv:2403.05530, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.377109Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:f58a62d848f76f41468f2638ea5443b6751ce8f799f537a59efe9f2842ba7764","observation_id":"5f9d92a7-117f-4199-b4b3-dfe6dd2d72e9","resolution":{"observed_at":"2026-08-07T05:38:59.377109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:38:59.464859Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.464859Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:e9f73abf2574f1515dd5856d1c4a7a951bf4555e36a2251e30db24970d9974e5","observation_id":"83ba023d-cbfb-4439-bba7-77341301036e","resolution":{"observed_at":"2026-08-07T05:38:59.464859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T05:38:59.546002Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.546002Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:24e26cb37b37f79065b2d0ac767a1d079c1af16d1ebf5f47230058813407f977","observation_id":"0c8dc9d2-db98-46ab-b742-339bc071c773","resolution":{"observed_at":"2026-08-07T05:38:59.546002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:03.148779Z","title":"Pixtral 12b.Mistral AI News, 2024.https://mistral.ai/news/pixtral-12bLast retrieved, April 25th, 2025","venue":null,"work_id":"37dfe9a8-83c0-4b09-9937-faa381b3ef2e","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.623333Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:808914938749a5146b2ecb9813bd2e11f7fff92f5ac453d67764236b5b492ea2","observation_id":"690bfc09-49da-4b96-893b-3cf4e768ce37","resolution":{"observed_at":"2026-08-07T05:39:03.227171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:02.966259Z","title":"Llama 3.2 vision 11b.Meta AI Blog, 2024.https://ai.meta.com/blog/ llama-3-2-connect-2024-vision-edge-mobile-devices/Last retrieved, April 25th, 2025","venue":null,"work_id":"da90d315-d294-4e32-bfcd-30227a754a46","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.711872Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:af608ce50977ea042c549ef115646ee3a14f533af619ac91c969a9830c3f7e9b","observation_id":"038865bd-3558-44ee-a4bc-43f4220e087e","resolution":{"observed_at":"2026-08-07T05:39:03.034380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:02.806151Z","title":"Llama 3.2 vision 90b.Meta AI Blog, 2024.https://ai.meta.com/blog/ llama-3-2-connect-2024-vision-edge-mobile-devices/Last retrieved, April 25th, 2025","venue":null,"work_id":"8d4d632d-a197-4ab6-a6bb-ee8f55ac4684","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.815322Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:2ae3b22de15b256da7652795e0fef77cc64470e3da130a98afa90e2714cddfb6","observation_id":"6f62abc5-0f3f-46ef-a12e-76aeb0052716","resolution":{"observed_at":"2026-08-07T05:39:02.886641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:02.643268Z","title":"Pixtral large.Mistral AI News, 2024.https://mistral.ai/news/pixtral-large Last retrieved, April 25th, 2025","venue":null,"work_id":"8f755e2d-22cb-4c3b-8d10-c46aedb8719f","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:59.925316Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:92bdc2865dbab2d8be077698d0fda4eee4d91e089715edf5c4afed1746bada55","observation_id":"3497ccd6-ef16-4153-856e-188d3b84e651","resolution":{"observed_at":"2026-08-07T05:39:02.746861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:02.504001Z","title":"Gpt-4o.OpenAI Documentation, 2024.https://platform.openai.com/docs/models Last retrieved, April 25th, 2025","venue":null,"work_id":"73625d2e-63f3-4ff9-a382-7a7fee580a98","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.023172Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:83179e6eeae74fd73a8f866568fec1eebd1048292abcd1d262bb14534c31ae0b","observation_id":"ab2100e2-8416-4dd2-b4f6-4323ec5a9866","resolution":{"observed_at":"2026-08-07T05:39:02.570734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:02.318235Z","title":"Gemini 2.0 flash.Google AI Blog, 2024.https://blog.google/technology/ai/ gemini-2-0-flash/Last retrieved, April 25th, 2025","venue":null,"work_id":"77cd2698-63dd-4526-b8f6-d32802e5ebf4","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.113148Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:bfdd191ef545fdec1331604235f01b518b6370801e29562d0b3b33b0d421c3f1","observation_id":"6a14e7c4-98a9-4cf5-8489-7a1132ca4f4b","resolution":{"observed_at":"2026-08-07T05:39:02.409137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:02.195502Z","title":"Gemini 2.0 flash lite.Google AI Blog, 2024.https://blog.google/technology/ai/ gemini-2-0-flash-lite/Last retrieved, April 25th, 2025","venue":null,"work_id":"626f912e-c43c-4c01-9952-32f44ac15930","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.238036Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:859a0d05cc3cb0da4ec5619565014e307b4c941ed683145aa18d49cb788b5577","observation_id":"8d7fae9c-9770-4187-81e9-32ad6a13f7b4","resolution":{"observed_at":"2026-08-07T05:39:02.243023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:02.029106Z","title":"Qwen2.5-vl 72b.GitHub Repository, 2024.https://github.com/QwenLM/Qwen2.5-VL Last retrieved, April 25th, 2025","venue":null,"work_id":"118129bf-5f40-46af-b323-dc1e27503c90","year":2024},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.305158Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:38f553a20b32f7a5f4677f9eb9f69d8ae69383d955ddf5159992dfdeee2f76c3","observation_id":"f00e5a31-7e5b-41ab-855f-3f97e42af644","resolution":{"observed_at":"2026-08-07T05:39:02.121010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:01.849759Z","title":"Australian Math Trust, 2025.https://www.amt.edu.au/ Last retrieved, April 25th, 2025","venue":null,"work_id":"7bd18d97-2d64-4239-a372-d74173a6453e","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.397520Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:76d5e35cd81a6476cf63b3f350c1ebf39ccb4a48ba0e7bbdc7215f6a8b12d80d","observation_id":"1b0fbfde-3c37-4e78-9479-eec4f713b624","resolution":{"observed_at":"2026-08-07T05:39:01.924226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:01.642718Z","title":"Kangaroo mathematics competition, 2025","venue":null,"work_id":"655fdfd8-9ac6-42d2-a5b4-8741b9bb0680","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.468727Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:f6fc56269a148aa1c0136ccb3d1a9f0aab19c0c440da990b4a415e307793e07e","observation_id":"d9315d22-26a3-40be-84ad-ba9dff0c6d1d","resolution":{"observed_at":"2026-08-07T05:39:01.732821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:01.466187Z","title":"Concurso Canguro de Matem´ aticas, 2025.https://canguromat.es/Last retrieved, April 25th, 2025","venue":null,"work_id":"cdba06fa-3b8d-4881-85ab-b11fb97b7ca1","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.567258Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:92b6a213fa573bee07c72d90906f04e10c4455ed3438a7dad4614640250adac0","observation_id":"cd56db18-9f26-4c6c-8acb-231b9d04268d","resolution":{"observed_at":"2026-08-07T05:39:01.559522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:01.273133Z","title":"Concours Kangourou de Math´ ematiques, 2025.https://www.aksf","venue":null,"work_id":"3bc2ad7e-e9cb-475f-85a3-37dec0c27d41","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.656507Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:6dfd77c56fdf45716b79d9fbaf6e3fb4857a1bb07c178845e44232ea0432b976","observation_id":"5cd0efb3-23a0-45a0-8ebd-0e81152075a3","resolution":{"observed_at":"2026-08-07T05:39:01.377765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:01.093134Z","title":"Concurs Cangur de Matem` atiques, 2025.https://scm.iec","venue":null,"work_id":"856f164f-0d24-45cd-bcb4-c7e8bb79da80","year":2025},"citing_paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:00.747897Z"},"links":{"citing_paper":"/paper/2506.07418"},"observation_digest":"sha256:620124584cd9bba7c914bd7da24a5b36d6d65d0cb04aca148be045df6daaf2b3","observation_id":"dbb4fb08-ac9f-4904-9217-c03ab09a386f","resolution":{"observed_at":"2026-08-07T05:39:01.164441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07418","last_updated":"2025-06-09T04:35:02Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T00:41:58.254546Z","submitted_at":"2025-06-09T04:35:02Z","title":"Evaluating Visual Mathematics in Multimodal LLMs: A Multilingual Benchmark Based on the Kangaroo Tests"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2506.07418."}