{"as_of":"2026-08-08T08:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ade88dfa332784ed109812fa95575240724ee31147a09262920b275f87a13978","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:19:05.167967Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T04:32:32.672779Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":"2401.11944","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cmmmu: A chinese massive multi-discipline multimodal understanding benchmark","venue":null,"work_id":"134d7fec-784b-4bf9-ad5c-dc50a17079c2","year":2024},"citing_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T16:51:32.094151Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T17:58:54.177359Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2403.05525"},"observation_digest":"sha256:def3622b40a942e2a3a4476ed7bbf460ed789449d604015f86b1e2b52e40ccf5","observation_id":"623d5a10-821a-485a-a79f-434c82c4544c","resolution":{"observed_at":"2026-05-11T17:58:54.760355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":"2401.11944","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cmmmu: A chinese massive multi-discipline multimodal understanding benchmark","venue":null,"work_id":"134d7fec-784b-4bf9-ad5c-dc50a17079c2","year":2024},"citing_paper":{"arxiv_id":"2501.00321","last_updated":"2025-06-05T02:59:05Z","snapshot_observed_at":"2026-08-07T17:13:10.057242Z","submitted_at":"2024-12-31T07:32:35Z","title":"OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning","version":2},"reference_index":131,"source":"pdf_text","source_observed_at":"2026-05-17T20:33:26.613927Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2501.00321"},"observation_digest":"sha256:68e1b0c44c5587d49e28a8e88a5906f1e827aaba44235a31c326320ba786fb7e","observation_id":"e18477da-9ef8-4c40-889f-ce3c5099ed29","resolution":{"observed_at":"2026-05-17T20:33:26.885629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":"2401.11944","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cmmmu: A chinese massive multi-discipline multimodal understanding benchmark","venue":null,"work_id":"134d7fec-784b-4bf9-ad5c-dc50a17079c2","year":2024},"citing_paper":{"arxiv_id":"2502.02871","last_updated":"2026-04-20T02:18:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T04:05:27Z","title":"Position: Multimodal Large Language Models Can Significantly Advance Scientific Reasoning","version":2},"reference_index":247,"source":"arxiv_source","source_observed_at":"2026-05-23T04:30:38.804702Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2502.02871"},"observation_digest":"sha256:0cc25c86c4087ba7b6d1cf85c54dc4015b9b8011b5570dd438ed49a7450101f9","observation_id":"68fc532c-d9aa-4e30-9e14-86a8f87eb304","resolution":{"observed_at":"2026-05-23T04:32:32.676271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-08-07T05:14:44.959144Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09081","last_updated":"2025-07-28T19:31:25Z","snapshot_observed_at":"2026-08-07T05:08:51.457285Z","submitted_at":"2025-06-10T04:19:02Z","title":"FlagEvalMM: A Flexible Framework for Comprehensive Multimodal Model Evaluation","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T05:14:44.959144Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2506.09081"},"observation_digest":"sha256:d6edd5f3f4b1de2359fd6d6c552496d030a498ebe8a5a7d9080f43007fc908cf","observation_id":"8dd42996-6022-4616-9e13-33f11b1ae93e","resolution":{"observed_at":"2026-08-07T05:14:44.959144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-08-07T04:22:56.098198Z","title":"Cmmmu: A chinese massive multi- discipline multimodal understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10857","last_updated":"2025-08-04T09:11:48Z","snapshot_observed_at":"2026-08-08T00:05:09.574699Z","submitted_at":"2025-06-12T16:17:17Z","title":"VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T04:22:56.098198Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2506.10857"},"observation_digest":"sha256:7ee03ab582f32e880cc5e631b8e4074045259e98c61b3ebca8859eb73ddecf8c","observation_id":"5aff777f-413d-4142-9836-e8741bc8053b","resolution":{"observed_at":"2026-08-07T04:22:56.098198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-08-07T11:19:05.167967Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14805","last_updated":"2025-08-12T17:07:53Z","snapshot_observed_at":"2026-08-08T00:05:33.094743Z","submitted_at":"2025-06-03T13:44:14Z","title":"Argus Inspection: Do Multimodal Large Language Models Possess the Eye of Panoptes?","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T11:19:05.167967Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2506.14805"},"observation_digest":"sha256:7e25caa2afc39a9bcbba635d927719b6d8dd493818e27ee747006a8e6ec43800","observation_id":"b1b73b5f-c11d-462a-87d9-feb48b3446d9","resolution":{"observed_at":"2026-08-07T11:19:05.167967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-08-06T18:04:55.471250Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09374","last_updated":"2025-07-12T18:44:32Z","snapshot_observed_at":"2026-08-07T21:26:10.688337Z","submitted_at":"2025-07-12T18:44:32Z","title":"EduFlow: Advancing MLLMs' Problem-Solving Proficiency through Multi-Stage, Multi-Perspective Critique","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T18:04:55.471250Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2507.09374"},"observation_digest":"sha256:83f7398d9a69597ff29c515fcdb3472c969e6b6a9d3297396c3dc714021658b8","observation_id":"ed9c1492-3022-4bba-a86d-b40b58a226c2","resolution":{"observed_at":"2026-08-06T18:04:55.471250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":"2401.11944","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cmmmu: A chinese massive multi-discipline multimodal understanding benchmark","venue":null,"work_id":"134d7fec-784b-4bf9-ad5c-dc50a17079c2","year":2024},"citing_paper":{"arxiv_id":"2604.09907","last_updated":"2026-04-10T21:08:18Z","snapshot_observed_at":"2026-07-06T22:58:38.807460Z","submitted_at":"2026-04-10T21:08:18Z","title":"From UAV Imagery to Agronomic Reasoning: A Multimodal LLM Benchmark for Plant Phenotyping","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:50.265856Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2604.09907"},"observation_digest":"sha256:9e24ca3bd96bbe3ff669090f7209288cf605fe70c6226651bb307cf46eb28398","observation_id":"4666b248-d71e-4a20-91fa-9d307d542e3f","resolution":{"observed_at":"2026-05-11T07:25:59.778943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":"2401.11944","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cmmmu: A chinese massive multi-discipline multimodal understanding benchmark","venue":null,"work_id":"134d7fec-784b-4bf9-ad5c-dc50a17079c2","year":2024},"citing_paper":{"arxiv_id":"2605.17283","last_updated":"2026-05-17T06:39:05Z","snapshot_observed_at":"2026-08-02T16:55:37.869194Z","submitted_at":"2026-05-17T06:39:05Z","title":"OProver: A Unified Framework for Agentic Formal Theorem Proving","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-20T14:43:46.517807Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2605.17283"},"observation_digest":"sha256:7980898a005f14be90f94dcc84175b76ab7091954eb24436d72676d130aaa1ba","observation_id":"6b981cda-3a3a-4f1d-aa23-b32c0d90ebe5","resolution":{"observed_at":"2026-05-20T14:48:23.548793Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2401.11944/citation-record","integrity":"/paper/2401.11944/integrity","json":"/paper/2401.11944/citation-record.json","paper":"/paper/2401.11944"},"outbound":[],"paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2401.11944."}