{"as_of":"2026-08-08T04:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:84fd232d92beb470789c551671519aff10157177da936c26224f53417f2ef4c8","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:04:36.266807Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.11080/citation-record","integrity":"/paper/2506.11080/integrity","json":"/paper/2506.11080/citation-record.json","paper":"/paper/2506.11080"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1905.13319","last_updated":"2019-05-30T21:28:12Z","snapshot_observed_at":"2026-07-06T07:56:54.143277Z","submitted_at":"2019-05-30T21:28:12Z","title":"MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13319","snapshot_observed_at":"2026-08-07T11:04:33.019433Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.019433Z"},"links":{"cited_paper":"/paper/1905.13319","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:3b016cc39eedc8acb3ccabb4f012546b424302d56713a93c9cd10ace5f5a1a37","observation_id":"9cbbc84f-f1cd-4c8e-94de-025e13f9b210","resolution":{"observed_at":"2026-08-07T11:04:33.019433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:33.100287Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.100287Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:4a9264f61831edad47b5d837d31859604e268bc45ce3c4359262efbee3c16c38","observation_id":"6fc41757-0bb0-4ca5-9a50-5ec21542d75b","resolution":{"observed_at":"2026-08-07T11:04:33.100287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-07T11:04:33.203398Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.203398Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:edf73d873b2d4f26e297f1abf3090de5b10a6183b1463c6ec4ba0f50450a3cf6","observation_id":"c4c0966f-75f9-43c1-94ef-c43269d723e0","resolution":{"observed_at":"2026-08-07T11:04:33.203398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-06T14:10:56.030769Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-07T11:04:33.269754Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.269754Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:b8efcda70c2036746f70456bba28f1f913d7872167af209456c70d5bd6390484","observation_id":"faf179a8-d2c9-4552-931e-acdd0bd8466a","resolution":{"observed_at":"2026-08-07T11:04:33.269754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:38.053555Z","title":null,"venue":null,"work_id":"974b6940-c208-4236-8f8e-97b6a2b60b39","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.342134Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ca8e65e9925ac2cd4502bebc01ecfbc29347213c1ef17fbb6cc8771332fa7311","observation_id":"e79d540c-5bd5-4e1e-b525-ad946d81fda6","resolution":{"observed_at":"2026-08-07T11:04:38.122814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.861199Z","title":null,"venue":null,"work_id":"4c3ca586-e522-43a5-943a-7e44b8c476d4","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.413796Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ba58fdcefb26ef1a3b2b90ba2def4b59726e8c33763ad407ee64a57933241c06","observation_id":"46b97ec5-2d1c-424f-aaac-7a0c7fe1c17b","resolution":{"observed_at":"2026-08-07T11:04:37.922036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T11:04:33.473651Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.473651Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9d4ea684b21267a05a7eb99e5c7d04e4e6f9b37ea38b04befd331effe44f18ba","observation_id":"45ff32d9-7ea2-4adc-885d-acb2aed40042","resolution":{"observed_at":"2026-08-07T11:04:33.473651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12390","last_updated":"2024-07-03T08:44:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-18T17:59:54Z","title":"BLINK: Multimodal Large Language Models Can See but Not Perceive","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12390","snapshot_observed_at":"2026-08-07T11:04:33.576525Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.576525Z"},"links":{"cited_paper":"/paper/2404.12390","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:90c1aec66738c5577ec13ef2094d81104a9efb15c19482019b48c6b0c343d95e","observation_id":"6840f7bc-b91c-4ab6-8362-746e39cd4238","resolution":{"observed_at":"2026-08-07T11:04:33.576525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T11:04:33.681836Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.681836Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ae68de0952b4983eb92e0222d1598eac4c720ed0f76b4a215e2b256c26c0172d","observation_id":"a7295d2f-a5da-461c-bb3a-9925fd622e13","resolution":{"observed_at":"2026-08-07T11:04:33.681836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T11:04:33.753861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.753861Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:f6e0e30cf05dd8f8d4ae2b3c0e5739bd0986eb3564d176060c5fa8a7217eff7b","observation_id":"79938242-1aaa-48e2-8de3-877f771a804b","resolution":{"observed_at":"2026-08-07T11:04:33.753861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:33.852870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.852870Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:33f535b754052ea63ae88b3e3fe56bf9d37e27ce95d690ab00f71418989b9eee","observation_id":"a1dfed1f-bfa6-46e5-a649-b08ab28235d8","resolution":{"observed_at":"2026-08-07T11:04:33.852870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.662057Z","title":null,"venue":null,"work_id":"810ee9a5-65ff-496a-b4eb-42e1ee14c10b","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.952899Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:973be546dcef8240c4536eac350fa9851a54cb19bf5ff192ee1f97cf5a0f26b2","observation_id":"f3cceeb6-bdc8-40de-8901-36b3e3619c04","resolution":{"observed_at":"2026-08-07T11:04:37.770114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-07T11:04:34.025517Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.025517Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:7099162d11217fffd540b12e8e5b2d84057f2159c625afbb0bad58546c4470ea","observation_id":"ced02137-89da-4243-82e2-44d681229640","resolution":{"observed_at":"2026-08-07T11:04:34.025517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.099423Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.099423Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:2f3f3014ae1edbb8d567f3ea29fc80a9ce345df8c638e28d73f31773768a35d0","observation_id":"c2780544-60bf-41f8-ae47-dc9314b71fe6","resolution":{"observed_at":"2026-08-07T11:04:34.099423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.194730Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.194730Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:f19185a7d8651bf57ffdd1e4f6b2b11357bd6e9788604fcf77de9c56a14987c3","observation_id":"d94c870a-ba9f-4acc-8d8c-bd44a87f2ac6","resolution":{"observed_at":"2026-08-07T11:04:34.194730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02718","last_updated":"2024-08-05T17:56:41Z","snapshot_observed_at":"2026-07-06T18:57:09.545013Z","submitted_at":"2024-08-05T17:56:41Z","title":"MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02718","snapshot_observed_at":"2026-08-07T11:04:34.275314Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.275314Z"},"links":{"cited_paper":"/paper/2408.02718","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:b54c5fb2aeaf72b1fa14082ca3fa7e72546e85282a0b66577e22c4fdea3657d1","observation_id":"de2927ee-074a-4a77-9fda-d5f316e2214b","resolution":{"observed_at":"2026-08-07T11:04:34.275314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.353892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.353892Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:313005e3e5d3c56576ebe9b7d708f1e56c683ea9879bfec08a5863d01b9bbd65","observation_id":"3b4515d8-05fb-458c-aa7c-fd9cf9c1bd68","resolution":{"observed_at":"2026-08-07T11:04:34.353892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.491571Z","title":null,"venue":null,"work_id":"edf7975c-83a3-4e95-9e2e-c0e18c29ab0d","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.481908Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:4e15c822bbbef3722c29c735c8d5cb742867ba090291527269319cc75fe74a6b","observation_id":"b38614fb-0d8e-44cd-9e28-7398a53e3386","resolution":{"observed_at":"2026-08-07T11:04:37.549855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.555811Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.555811Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:62955327590e69abc07acb6214c39c47af925b8d95eb51d06fb8975d45dd2c1c","observation_id":"6a764844-966c-4a55-adf4-7d89ad29ec5f","resolution":{"observed_at":"2026-08-07T11:04:34.555811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.627505Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.627505Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:486bb93cb114da1380e434fb6d1ab814d0ef54a1c38ca55e4b2c80e2e95c7a6a","observation_id":"84ea90b2-4610-4482-9b1e-57435bfd7e6f","resolution":{"observed_at":"2026-08-07T11:04:34.627505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0575","last_updated":"2015-01-30T01:23:59Z","snapshot_observed_at":"2026-07-06T03:53:12.119259Z","submitted_at":"2014-09-01T22:29:38Z","title":"ImageNet Large Scale Visual Recognition Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0575","snapshot_observed_at":"2026-08-07T11:04:34.736985Z","title":"Berg, and Li Fei-Fei","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.736985Z"},"links":{"cited_paper":"/paper/1409.0575","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9f75e3cfda73b3334735c24c861ce941c9c74ee4cd4f3ff18c87083ba9f9b8f1","observation_id":"ce03bda5-2ee7-4d7d-b199-22debc836638","resolution":{"observed_at":"2026-08-07T11:04:34.736985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.326493Z","title":null,"venue":null,"work_id":"8219a9a0-e4a7-4da7-b7d3-a51eb54c8f5d","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.811098Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:b94ca230819c822ed0888c5fcdba51939b2c90e94da745c068576dc4a0b46d42","observation_id":"aa645b74-9800-47bf-8a4a-9f9697541a3d","resolution":{"observed_at":"2026-08-07T11:04:37.398739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.134140Z","title":null,"venue":null,"work_id":"8179f505-44b7-41ab-a9c1-210ead33d49b","year":2025},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.906468Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ffbea3de0675bf5c853504c8824f03ee1f5d3be84f1479a7c859f752d42f665f","observation_id":"10dcd35f-3ad8-4473-9d3b-2533e9f33ab9","resolution":{"observed_at":"2026-08-07T11:04:37.245133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T11:04:34.957896Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.957896Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:bf282655452f2f03a51964ed6701fddbe17f834f1af65081493f6ab2e3116d48","observation_id":"91cdb192-d7c1-4429-8c88-834a38467284","resolution":{"observed_at":"2026-08-07T11:04:34.957896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.025818Z","title":null,"venue":null,"work_id":"fdaf4b91-048b-465d-b564-fae97e1cda42","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.053070Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9da9f391808227290e9ea66d4b1866b1d40050010aad08427ff534dc791639e4","observation_id":"178da340-62c3-46c5-b605-1794e37e26ea","resolution":{"observed_at":"2026-08-07T11:04:37.077215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:35.122944Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.122944Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:f78ab4cdcf87158b0a9513a10b04dff7c13b0df99d2aa15e475a1e25839be7db","observation_id":"1ff12e9b-7eac-4590-aa1a-a924fec77b41","resolution":{"observed_at":"2026-08-07T11:04:35.122944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09411","last_updated":"2024-07-02T01:56:14Z","snapshot_observed_at":"2026-08-06T10:53:26.005728Z","submitted_at":"2024-06-13T17:59:52Z","title":"MuirBench: A Comprehensive Benchmark for Robust Multi-image Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09411","snapshot_observed_at":"2026-08-07T11:04:35.321699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.321699Z"},"links":{"cited_paper":"/paper/2406.09411","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:89f8b1fc2084d1cd12a9adaa19586243f17b13a6208ca73533273e8570fb71aa","observation_id":"b143a180-e90c-4d7c-8a66-0230a099cedf","resolution":{"observed_at":"2026-08-07T11:04:35.321699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14804","last_updated":"2024-02-22T18:56:38Z","snapshot_observed_at":"2026-08-06T04:41:26.667478Z","submitted_at":"2024-02-22T18:56:38Z","title":"Measuring Multimodal Mathematical Reasoning with MATH-Vision Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14804","snapshot_observed_at":"2026-08-07T11:04:35.401166Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.401166Z"},"links":{"cited_paper":"/paper/2402.14804","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:72c487b296f7b0d72ddcd5d5bdaf7b8839c75d937e61425c437c8dc04931c7c5","observation_id":"cbe520ed-f158-447a-9e94-ed8fce53cbd6","resolution":{"observed_at":"2026-08-07T11:04:35.401166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T11:04:35.585470Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.585470Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ba435470faed3cb9301e068b9f6473772d3677bb6989df5ed9cdca209133ed12","observation_id":"0a02c4e2-b065-46fe-8300-7b4fba8ddcc1","resolution":{"observed_at":"2026-08-07T11:04:35.585470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10442","snapshot_observed_at":"2026-08-07T11:04:35.660401Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.660401Z"},"links":{"cited_paper":"/paper/2411.10442","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:fd481262ed695fa7d81e78bfc0000798f465957b0aacbf36a8a64d9e1cb452da","observation_id":"9697a96f-5196-47ad-9dad-7c8174cf9069","resolution":{"observed_at":"2026-08-07T11:04:35.660401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19314","snapshot_observed_at":"2026-08-07T11:04:35.770013Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.770013Z"},"links":{"cited_paper":"/paper/2406.19314","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:6279bab34c5056f8f79366fbc836c19e01a44ad69b5fa92d64ec77ff6892d641","observation_id":"6f69844b-b07b-468b-9e95-fa2590d3990c","resolution":{"observed_at":"2026-08-07T11:04:35.770013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T11:04:35.843690Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.843690Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:6c608359327a1f961757e792c4494f299bdcfdcf4d2d6005c55496f0ea6bc2b3","observation_id":"85842938-03b8-4905-9646-413aee53cda0","resolution":{"observed_at":"2026-08-07T11:04:35.843690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:35.920353Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.920353Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ca97cf43ac6a4e734194bf44922fa23944d470fbed257e795de93e2179997f0a","observation_id":"bc046f9a-de8e-4942-814f-7be1158cc679","resolution":{"observed_at":"2026-08-07T11:04:35.920353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00332","last_updated":"2024-11-22T22:27:49Z","snapshot_observed_at":"2026-07-06T18:08:04.815730Z","submitted_at":"2024-05-01T05:52:05Z","title":"A Careful Examination of Large Language Model Performance on Grade School Arithmetic","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00332","snapshot_observed_at":"2026-08-07T11:04:36.030597Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:36.030597Z"},"links":{"cited_paper":"/paper/2405.00332","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9fdaaea96a9eca86fbbd7c9b13c9656b09eb7eab499763d0d23f105bdcf52021","observation_id":"9a2fe13c-2714-4032-b3f4-6bdb30c1446e","resolution":{"observed_at":"2026-08-07T11:04:36.030597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:36.818905Z","title":null,"venue":null,"work_id":"c059e584-6b08-4d58-9318-baedfeaed827","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:36.122616Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:1495723913cf0c31c0e2055742bcf92929e18fa8133bca5200b7f737903ac8c3","observation_id":"57dceeea-435a-43b1-87b3-602d38865fa7","resolution":{"observed_at":"2026-08-07T11:04:36.917406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T11:04:36.266807Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:36.266807Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:aaf2f36114adf608883b5530505dd71dcd1f02b7fab636398cd8eb15e84bedd7","observation_id":"94a18d1e-2c73-4c44-8f0f-5ff4448a9ece","resolution":{"observed_at":"2026-08-07T11:04:36.266807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T10:54:35.812351Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.11080."}