{"as_of":"2026-08-23T19:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:309bf5dcc4258dd51196ad37fb14aa70c474cf9415c9515dce433dada7516235","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:24:12.097192Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T10:34:07.256051Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.15769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":"319b06ca-1ddb-41da-b7a6-7b8152c3a443","year":2024},"citing_paper":{"arxiv_id":"2411.18279","last_updated":"2025-05-06T15:08:00Z","snapshot_observed_at":"2026-08-17T10:40:45.253009Z","submitted_at":"2024-11-27T12:13:39Z","title":"Large Language Model-Brained GUI Agents: A Survey","version":12},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-19T11:08:27.472508Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2411.18279"},"observation_digest":"sha256:d7e1d2b241d7695ec0efa5ed0c442efcb3cfd1eaf03d0e51b1e98b01c42e900e","observation_id":"04abcfd6-1a15-454f-a924-b65aa7dcd855","resolution":{"observed_at":"2026-05-19T11:08:28.036970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-11T23:54:23.655726Z","title":"A survey on evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02104","last_updated":"2024-12-03T02:54:31Z","snapshot_observed_at":"2026-08-16T12:56:12.864592Z","submitted_at":"2024-12-03T02:54:31Z","title":"Explainable and Interpretable Multimodal Large Language Models: A Comprehensive Survey","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-11T23:54:23.655726Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2412.02104"},"observation_digest":"sha256:3369872486b7d0f8cec43327022141623e30219b381dfe5618687844bdcc114a","observation_id":"ec607f9a-a940-4aa7-91db-7c1eca2d044a","resolution":{"observed_at":"2026-08-11T23:54:23.655726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-11T04:53:11.781191Z","title":"and Zhang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-15T19:40:30.225099Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T04:53:11.781191Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2412.18319"},"observation_digest":"sha256:0d3bca6330796e039daeba7d4080aaee0325eab930a58d2c5b80e93df8592af7","observation_id":"37a6830a-9e8e-43ea-953f-aec62da1ffe3","resolution":{"observed_at":"2026-08-11T04:53:11.781191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-11T14:59:01.859085Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18619","last_updated":"2024-12-30T03:00:30Z","snapshot_observed_at":"2026-08-21T08:28:48.041857Z","submitted_at":"2024-12-16T05:02:25Z","title":"Next Token Prediction Towards Multimodal Intelligence: A Comprehensive Survey","version":2},"reference_index":168,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:01.859085Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2412.18619"},"observation_digest":"sha256:2f42d68e04772b8e91a51967f5730bcd9fccb1c4bf5c774c2f6465f810a63848","observation_id":"d4471af5-eab1-4499-b9f6-648073ee7d76","resolution":{"observed_at":"2026-08-11T14:59:01.859085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-10T23:10:33.015365Z","title":"A survey on evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20927","last_updated":"2024-12-30T13:16:08Z","snapshot_observed_at":"2026-08-20T20:40:16.159770Z","submitted_at":"2024-12-30T13:16:08Z","title":"Enhanced Multimodal RAG-LLM for Accurate Visual Question Answering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T23:10:33.015365Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2412.20927"},"observation_digest":"sha256:029ebd846f3ab9064e436589399cf622ce55e9893a9cc2b8534ae66b0c134007","observation_id":"00933da5-cdf5-4a31-b37a-4f39eab45692","resolution":{"observed_at":"2026-08-10T23:10:33.015365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-10T19:06:46.194763Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10674","last_updated":"2025-02-18T09:51:00Z","snapshot_observed_at":"2026-08-15T10:47:20.649898Z","submitted_at":"2025-01-18T06:41:48Z","title":"Can Multimodal LLMs do Visual Temporal Understanding and Reasoning? The answer is No!","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T19:06:46.194763Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2501.10674"},"observation_digest":"sha256:2327c1f7a7c7acb5246ff4bb0d700af74f195b238897e6ee2c290bba2add599c","observation_id":"7e1cb9d6-6066-465c-97fb-6a20d02cbeac","resolution":{"observed_at":"2026-08-10T19:06:46.194763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.15769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":"319b06ca-1ddb-41da-b7a6-7b8152c3a443","year":2024},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":289,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:0b54c671285246e9ae88d133a45d48f4f2d7c2c0bf3474d3f5df4edad936f73b","observation_id":"73dd6bd7-988e-42e1-a932-9b5a3e87f154","resolution":{"observed_at":"2026-05-12T08:40:41.688765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-16T11:24:12.097192Z","title":"A survey on evaluation of JOURNAL OF LATEX CLASS FILES, VOL. 14, NO. 8, AUGUST 2015 38 multimodal large language models,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.15585","last_updated":"2025-06-09T02:36:20Z","snapshot_observed_at":"2026-08-17T21:55:02.668814Z","submitted_at":"2025-04-22T05:02:49Z","title":"A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:24:12.097192Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2504.15585"},"observation_digest":"sha256:077117d76705f0df8dea9fb07cb5839ba033fec3c1a9c44ddc012d9afc78157a","observation_id":"3bd41662-074e-4ff0-ac5a-ffa8f1d94484","resolution":{"observed_at":"2026-08-16T11:24:12.097192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-16T10:12:00.700076Z","title":"A survey on evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18838","last_updated":"2025-04-26T07:48:52Z","snapshot_observed_at":"2026-08-17T04:06:12.060099Z","submitted_at":"2025-04-26T07:48:52Z","title":"Toward Generalizable Evaluation in the LLM Era: A Survey Beyond Benchmarks","version":1},"reference_index":143,"source":"pdf_text","source_observed_at":"2026-08-16T10:12:00.700076Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2504.18838"},"observation_digest":"sha256:6ef24372a554ef4c05d24d755fe58c0050e1ad3b7b56ac7b8442e11ec3ddf646","observation_id":"bbe1d679-9c90-4203-9523-e2d6fdc4b450","resolution":{"observed_at":"2026-08-16T10:12:00.700076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-07T14:16:55.906329Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19509","last_updated":"2025-05-26T04:39:30Z","snapshot_observed_at":"2026-08-23T15:26:32.940651Z","submitted_at":"2025-05-26T04:39:30Z","title":"Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:55.906329Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2505.19509"},"observation_digest":"sha256:0c2a532ec356950437f74cc588dd53b7e4b3cdb3e30d6651455a1266fcac7732","observation_id":"6023184c-710a-4066-a4cb-332ab1951308","resolution":{"observed_at":"2026-08-07T14:16:55.906329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-07T05:36:15.568736Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-19T00:01:34.914966Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.568736Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:90e5bdc6f078a72e98847da11983a1a91dcd6ad0ce7466ade810b2dc2f03a056","observation_id":"c2252e6d-8f3a-4ad4-81d6-87a0f853c88b","resolution":{"observed_at":"2026-08-07T05:36:15.568736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.15769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":"319b06ca-1ddb-41da-b7a6-7b8152c3a443","year":2024},"citing_paper":{"arxiv_id":"2506.09082","last_updated":"2026-05-03T04:37:38Z","snapshot_observed_at":"2026-08-18T09:58:59.618504Z","submitted_at":"2025-06-10T05:43:34Z","title":"AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T11:12:41.130806Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2506.09082"},"observation_digest":"sha256:626cd60b180161e5bc517a2ff8b940aed27ad0da36d33798e16e52244f53631f","observation_id":"f09d3e57-92b7-4da0-9496-38c4d707aeac","resolution":{"observed_at":"2026-05-19T11:13:02.831115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-15T19:45:10.154494Z","title":"A survey on evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15170","last_updated":"2025-08-01T10:42:39Z","snapshot_observed_at":"2026-08-16T15:33:53.252333Z","submitted_at":"2025-06-18T06:33:19Z","title":"From LLMs to MLLMs to Agents: A Survey of Emerging Paradigms in Jailbreak Attacks and Defenses within LLM Ecosystem","version":3},"reference_index":138,"source":"pdf_text","source_observed_at":"2026-08-15T19:45:10.154494Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2506.15170"},"observation_digest":"sha256:ed6ea1121748f0b44ca11b69795e417d3d899bfc028860b1ace052d5a802b6e6","observation_id":"3b6839a1-2a9a-4720-84af-974319007cc1","resolution":{"observed_at":"2026-08-15T19:45:10.154494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-05T12:44:46.842259Z","title":"A survey on evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.842259Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:373523314a51db38949dfbd7c9c2dca71065f02ec5d7ac07b4832c7082db60d2","observation_id":"6d1b235c-0761-47ee-8af3-9719f156e79b","resolution":{"observed_at":"2026-08-05T12:44:46.842259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.15769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":"319b06ca-1ddb-41da-b7a6-7b8152c3a443","year":2024},"citing_paper":{"arxiv_id":"2603.16284","last_updated":"2026-05-19T06:59:25Z","snapshot_observed_at":"2026-08-16T11:11:05.904648Z","submitted_at":"2026-03-17T09:16:50Z","title":"Locate-then-Sparsify: Attribution Guided Sparse Strategy for Visual Hallucination Mitigation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T10:32:41.447253Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2603.16284"},"observation_digest":"sha256:99f0d89a9858d04575cb98769ef3d0ec4d9955749c88d8b3c1424b505ae933d7","observation_id":"7b2b85b1-491e-4086-bd9c-b0819c6da1b1","resolution":{"observed_at":"2026-05-21T10:34:07.258882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.15769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":"319b06ca-1ddb-41da-b7a6-7b8152c3a443","year":2024},"citing_paper":{"arxiv_id":"2604.08703","last_updated":"2026-04-09T18:51:16Z","snapshot_observed_at":"2026-08-13T02:01:29.233633Z","submitted_at":"2026-04-09T18:51:16Z","title":"QoS-QoE Translation with Large Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T17:01:57.703684Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2604.08703"},"observation_digest":"sha256:936442cc5c34823f7d9cd97496221c593618de72552568e2844dc31f60c5bb3b","observation_id":"ff959bb2-be03-4605-ab1a-9684f071899b","resolution":{"observed_at":"2026-05-11T07:41:01.175195Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.15769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":"319b06ca-1ddb-41da-b7a6-7b8152c3a443","year":2024},"citing_paper":{"arxiv_id":"2605.06115","last_updated":"2026-05-08T03:43:00Z","snapshot_observed_at":"2026-08-19T13:53:51.745319Z","submitted_at":"2026-05-07T12:26:11Z","title":"CrossCult-KIBench: A Benchmark for Cross-Cultural Knowledge Insertion in MLLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T10:34:33.399684Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2605.06115"},"observation_digest":"sha256:d1d62bcda03eaf75fe044c269a249ebc80ba3bd1d54da91f23eb01793216d0d8","observation_id":"a26a0f95-4b7b-49c8-ba2d-a90c8f330a53","resolution":{"observed_at":"2026-05-11T20:01:08.880958Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.15769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":"319b06ca-1ddb-41da-b7a6-7b8152c3a443","year":2024},"citing_paper":{"arxiv_id":"2605.06115","last_updated":"2026-05-08T03:43:00Z","snapshot_observed_at":"2026-08-19T13:53:51.745319Z","submitted_at":"2026-05-07T12:26:11Z","title":"CrossCult-KIBench: A Benchmark for Cross-Cultural Knowledge Insertion in MLLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T00:49:23.895938Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2605.06115"},"observation_digest":"sha256:c5fcb718bdc6d3a9b41c8eacb46c7b13598ac4028047c91531718b5a9ba47e06","observation_id":"66c826d2-5bb5-46b3-a91a-e361fe3713d3","resolution":{"observed_at":"2026-05-11T00:50:49.680393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-05T12:40:15.292794Z","title":"arXiv preprint arXiv:2408.15769 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03782","last_updated":"2026-08-04T15:03:29Z","snapshot_observed_at":"2026-08-14T15:49:06.612815Z","submitted_at":"2026-08-04T15:03:29Z","title":"KnowHal: A Knowledge-Driven Benchmark for Comprehensive Multimodal Hallucination Evaluation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T12:40:15.292794Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2608.03782"},"observation_digest":"sha256:5f16ee19d12cf8b8917734b93a5824483d2c227d7ed450c169a2f4b7cdc54003","observation_id":"fdb1882c-9298-4079-854e-465c923a66c0","resolution":{"observed_at":"2026-08-05T12:40:15.292794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-12T14:37:29.980951Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10908","last_updated":"2026-08-11T13:29:03Z","snapshot_observed_at":"2026-08-22T14:01:01.646586Z","submitted_at":"2026-08-11T13:29:03Z","title":"Order Matters: LVLMs as Judges for Temporal Reasoning in Image Sequences","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:37:29.980951Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2608.10908"},"observation_digest":"sha256:32739635bfd428a60253d85113e8b74034462620fb8b5a999c9358cdf661ad4a","observation_id":"efed6e94-41bb-432a-b7d6-2927cea06f9f","resolution":{"observed_at":"2026-08-12T14:37:29.980951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2408.15769/citation-record","integrity":"/paper/2408.15769/integrity","json":"/paper/2408.15769/citation-record.json","paper":"/paper/2408.15769"},"outbound":[],"paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2408.15769."}