{"as_of":"2026-08-09T16:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b5824818953d6f73b6c3c94146075f10ba33fa4c981d112c365ca67251ec3d6","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T23:20:01.204321Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:30:08.756767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:40:07.536409Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04176","snapshot_observed_at":"2026-08-07T04:30:08.756767Z","title":"Mramg- bench: A beyondtext benchmark for multimodal retrieval- augmented multimodal generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10408","last_updated":"2025-06-12T07:01:56Z","snapshot_observed_at":"2026-08-07T04:25:00.939181Z","submitted_at":"2025-06-12T07:01:56Z","title":"Reasoning RAG via System 1 or System 2: A Survey on Reasoning Agentic Retrieval-Augmented Generation for Industry Challenges","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:30:08.756767Z"},"links":{"cited_paper":"/paper/2502.04176","citing_paper":"/paper/2506.10408"},"observation_digest":"sha256:a126642308ae012960baf5917623fb6322189680f822c5404b113366e68d3953","observation_id":"064feb79-9ef9-4f0c-996c-f11af597f472","resolution":{"observed_at":"2026-08-07T04:30:08.756767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"cited_work":{"arxiv_id":"2502.04176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04176","snapshot_observed_at":"2026-07-04T20:40:07.536409Z","title":"arXiv preprint arXiv:2502.04176 , year=","venue":null,"work_id":"08482678-a902-43a3-8388-f734bbc22fcd","year":null},"citing_paper":{"arxiv_id":"2606.26079","last_updated":"2026-06-24T17:53:26Z","snapshot_observed_at":"2026-08-08T12:16:57.837000Z","submitted_at":"2026-06-24T17:53:26Z","title":"Same Evidence, Different Answer: Auditing Order Sensitivity in Multimodal Large Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-25T19:58:23.594907Z"},"links":{"cited_paper":"/paper/2502.04176","citing_paper":"/paper/2606.26079"},"observation_digest":"sha256:77c6d20eba98275847e02d86ef4986994ee3288d47a790245dea6b8b31f07841","observation_id":"412345b8-5035-4ef3-9176-7deb5fbe1a2f","resolution":{"observed_at":"2026-07-04T20:40:07.538163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04176/citation-record","integrity":"/paper/2502.04176/integrity","json":"/paper/2502.04176/citation-record.json","paper":"/paper/2502.04176"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:00.963580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.963580Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:5a76911433d3edc4147a98145aef23a15b92647b9c1534a46c6326c6ab3f5300","observation_id":"dc9e559f-d767-43c6-89d9-131cf994bb62","resolution":{"observed_at":"2026-08-08T23:20:00.963580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-08T23:20:00.968048Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.968048Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:8ec51d6d18a8d40cb07b1b087ad138339a847ab854af9d67111af2dd015414f7","observation_id":"d514c9de-8493-4418-94c1-1bf6cfd9f34c","resolution":{"observed_at":"2026-08-08T23:20:00.968048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05432","last_updated":"2023-05-09T13:20:59Z","snapshot_observed_at":"2026-08-01T10:33:20.255056Z","submitted_at":"2023-05-09T13:20:59Z","title":"WikiWeb2M: A Page-Level Multimodal Wikipedia Dataset","version":1},"cited_work":{"arxiv_id":"2305.05432","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.05432","snapshot_observed_at":"2026-08-08T23:20:01.468981Z","title":"WikiWeb2M: A Page-Level Multimodal Wikipedia Dataset","venue":"cs.CL","work_id":"8cafd07e-d1d7-41c2-b64d-f5ed2fd040c5","year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.972117Z"},"links":{"cited_paper":"/paper/2305.05432","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:9a5fd50f3bb8691280cc8b2727a8f7c3f84ad21c2e2f3b7e23fb87edae0e854c","observation_id":"3a24ebba-a154-46db-be7a-42df2939375e","resolution":{"observed_at":"2026-08-08T23:20:01.476263Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.644157Z","title":null,"venue":null,"work_id":"9627fbe5-e5b8-43ac-835e-59f3a0bf7b9b","year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.975898Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:642e4eb9aafdca06e4b6de19b4a9a595640b32d29715a46d6e33daa0ebd51e8a","observation_id":"7ffb8d29-0fbf-43c1-929e-ae2e4a951736","resolution":{"observed_at":"2026-08-08T23:20:01.647144Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-07-06T17:25:35.493362Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-08T23:20:00.979616Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.979616Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:afedc01d38db06bab51948c3fbfd7bf0a379c978c6b4b9f21ebe94464d8aed66","observation_id":"ad6323e6-addb-4e8c-aedc-4305e405d28b","resolution":{"observed_at":"2026-08-08T23:20:00.979616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02928","last_updated":"2022-10-20T17:16:27Z","snapshot_observed_at":"2026-08-06T23:46:49.824788Z","submitted_at":"2022-10-06T13:58:03Z","title":"MuRAG: Multimodal Retrieval-Augmented Generator for Open Question Answering over Images and Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02928","snapshot_observed_at":"2026-08-08T23:20:00.983801Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.983801Z"},"links":{"cited_paper":"/paper/2210.02928","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:8500fd6a1215a29ca2638303b0fdb576f9512f56f0932a86ac97866a4b506c23","observation_id":"d2f0424b-b94b-4aae-9e70-994e4d7507bc","resolution":{"observed_at":"2026-08-08T23:20:00.983801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-08T23:20:00.987901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.987901Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:796579e601250f6a246b5dd6e87ec1f6c0157a0b255b5b54b7ea9bb49533395a","observation_id":"43321dff-4be8-48d7-8055-8195a6e15781","resolution":{"observed_at":"2026-08-08T23:20:00.987901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T23:20:00.991692Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.991692Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:2dc2e0d473eba2850f85a3053fd2e5d2f04ed6145a3337481be3fdc22450fabd","observation_id":"ca3ee25c-58a3-430c-93da-15be130f60e3","resolution":{"observed_at":"2026-08-08T23:20:00.991692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T23:20:00.996182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.996182Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:67037bae258276e5e21371ab1094a103be059b21b82bd35b077618f735395ffa","observation_id":"1de530e1-634d-4e33-96a5-99d5679dacb8","resolution":{"observed_at":"2026-08-08T23:20:00.996182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:00.999923Z","title":null,"venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:00.999923Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:0e1442caeba3d449eb925198b70d8326ec6bf35a77e723d0bb53bdd8fd8d73f4","observation_id":"79ec296d-fa21-4558-b7e0-f177ce35511c","resolution":{"observed_at":"2026-08-08T23:20:00.999923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15217","last_updated":"2025-04-28T05:09:12Z","snapshot_observed_at":"2026-08-05T02:02:34.574070Z","submitted_at":"2023-09-26T19:23:54Z","title":"Ragas: Automated Evaluation of Retrieval Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15217","snapshot_observed_at":"2026-08-08T23:20:01.003475Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.003475Z"},"links":{"cited_paper":"/paper/2309.15217","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:3d1ed67579cfe233b0ef833898eac3bd1b3491e50852459e016391fe4266aea1","observation_id":"437b61c3-6d98-423a-921a-2018e88794e5","resolution":{"observed_at":"2026-08-08T23:20:01.003475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.08614","last_updated":"2022-05-05T04:20:06Z","snapshot_observed_at":"2026-07-06T12:19:22.234875Z","submitted_at":"2021-12-16T04:37:10Z","title":"KAT: A Knowledge Augmented Transformer for Vision-and-Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.08614","snapshot_observed_at":"2026-08-08T23:20:01.008761Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.008761Z"},"links":{"cited_paper":"/paper/2112.08614","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:7a290121fa427d1f276371d683ddda158985f9979f9ddcb199afb150e5238735","observation_id":"f80fd8c1-cbf8-4f06-9b3e-ffd6659b9abf","resolution":{"observed_at":"2026-08-08T23:20:01.008761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08406","last_updated":"2024-01-30T13:55:34Z","snapshot_observed_at":"2026-07-06T17:16:13.055978Z","submitted_at":"2024-01-16T14:44:47Z","title":"RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08406","snapshot_observed_at":"2026-08-08T23:20:01.012259Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.012259Z"},"links":{"cited_paper":"/paper/2401.08406","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:ef611ca418f05555ef8830fcf73330c82ead363a35a7f2610f194e7211b40cc4","observation_id":"90134a62-5c2b-4768-acb7-547d2d876932","resolution":{"observed_at":"2026-08-08T23:20:01.012259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-08T23:20:01.015830Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.015830Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:55577c9c6c9fca348b72a77fdfeec32c163006719bba5077bae3dfb7177808b8","observation_id":"6ea5f90e-fde6-493a-a325-4903327ebaef","resolution":{"observed_at":"2026-08-08T23:20:01.015830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12959","last_updated":"2024-11-27T08:49:12Z","snapshot_observed_at":"2026-07-06T19:18:17.523057Z","submitted_at":"2024-09-19T17:59:45Z","title":"MMSearch: Benchmarking the Potential of Large Models as Multi-modal Search Engines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12959","snapshot_observed_at":"2026-08-08T23:20:01.019195Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.019195Z"},"links":{"cited_paper":"/paper/2409.12959","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:76eea202aff25a7fe4871e59f5ce406affd0e93d0c9de3f8c1ce990ccba92931","observation_id":"8921ecbe-3616-46d2-a40c-2465f21ba7c7","resolution":{"observed_at":"2026-08-08T23:20:01.019195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.635156Z","title":null,"venue":null,"work_id":"7a7b31ee-9bac-4fe9-a866-e32235029524","year":1973},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.022969Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:924f69df3ac335af0af2ccf076cbdea7e4884b2ebca300687b58976a9bf3eda7","observation_id":"88fb0ce0-bb3f-4458-a746-9ea86cc554c7","resolution":{"observed_at":"2026-08-08T23:20:01.638511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.626264Z","title":null,"venue":null,"work_id":"03c024a9-3d32-4772-b8af-dfc7f115b17a","year":2017},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.026324Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:d3d08930281e65735c710c3b1da9935def2e22cf258dd16c83b04c86615e2600","observation_id":"2178f723-5ec4-4a05-a08b-d52092de6bcc","resolution":{"observed_at":"2026-08-08T23:20:01.629626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08802","last_updated":"2025-04-24T16:22:33Z","snapshot_observed_at":"2026-08-07T19:56:45.144619Z","submitted_at":"2024-12-11T22:28:12Z","title":"jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08802","snapshot_observed_at":"2026-08-08T23:20:01.029650Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.029650Z"},"links":{"cited_paper":"/paper/2412.08802","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:38a688d43493d5ea096113fd14a1e50130c13b935693c0662285383a7e776fff","observation_id":"a37951d5-4c65-4996-8dbf-85523f262b56","resolution":{"observed_at":"2026-08-08T23:20:01.029650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.033810Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.033810Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:368f7a166f55b33ff8b5a9e5a6cf58f6ed3b3f969bcb0a70a89e4589d93408a7","observation_id":"cdf9a4d7-3dec-4341-ba60-4a7545620d76","resolution":{"observed_at":"2026-08-08T23:20:01.033810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.612688Z","title":null,"venue":null,"work_id":"9ff91d0e-495d-4039-a422-b4a6a7c584bf","year":2020},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.047532Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:dede53d48b65f82346d6ba1c0f7c5be9ad083d80895d1154b5e187ad0cf4e746","observation_id":"eb6ea0f1-5e91-4b31-a827-d4ea99000d8a","resolution":{"observed_at":"2026-08-08T23:20:01.615906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.053365Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.053365Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:c7a02e38fafdde906d643c66a80ae8b1eace0581947db451513690d9d4e5e7f2","observation_id":"f5eaa238-35e2-4d40-9b94-3cd644d66d62","resolution":{"observed_at":"2026-08-08T23:20:01.053365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-08T23:20:01.057079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.057079Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:70fc34f984a12b2f712ac2db1f93bd1aa098c2c23b39b288052165111fc8b78a","observation_id":"9538a13a-9d2b-4ddf-8226-c174c3ddb07c","resolution":{"observed_at":"2026-08-08T23:20:01.057079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.598782Z","title":null,"venue":null,"work_id":"b97a8b00-ebf0-41b4-8a92-88b39e1c8042","year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.060763Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:fe5658ada9065f01d2416ddf242452ba224c8e9e6c3a482d5a4469ab90b776a6","observation_id":"a956a995-265c-402f-b209-7a4e5374e7b8","resolution":{"observed_at":"2026-08-08T23:20:01.601924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.064089Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.064089Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:5af2e32bb1243f0250555db9fddda391dbf0d33d0b2077c806b5d2dc83f9b029","observation_id":"1dbd175a-0f78-46ac-bbde-619fdc5c7fe5","resolution":{"observed_at":"2026-08-08T23:20:01.064089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.589584Z","title":null,"venue":null,"work_id":"1c5ebcee-3eb1-4d08-a842-fce9977d2bf4","year":null},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.067452Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:8e56b72fb34b77136dd636ca4aef3cafc9bdcbccace0137f8931ff96c31d6d94","observation_id":"dc1f6bf2-1fb4-4a3d-87db-c09205a667ac","resolution":{"observed_at":"2026-08-08T23:20:01.593000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.074661Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.074661Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:ebf7baa5a0791d6e32ed4a738766095f1c09d428b8f6236927282106dbf6e47c","observation_id":"957371e7-3cf7-474d-8f95-5d55219a6f75","resolution":{"observed_at":"2026-08-08T23:20:01.074661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.574532Z","title":null,"venue":null,"work_id":"58650759-455b-4382-a1c4-ce3de8fa537f","year":2016},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.084747Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:290fdd834531f4d69d49d037183a19c2d4b9e7992ebd18cc5e7d773e218151ca","observation_id":"c077fc8b-8275-43b2-bc75-478b5ca2888b","resolution":{"observed_at":"2026-08-08T23:20:01.578006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.564249Z","title":null,"venue":null,"work_id":"94c46daa-b69c-4564-9b53-6de7805d6f89","year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.093697Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:cdc776209d14b60abf610db064debcf2db235c038800f6d5f7b1cc148ddf6710","observation_id":"9c3a9d43-9c71-4611-aca0-107f674ed545","resolution":{"observed_at":"2026-08-08T23:20:01.568137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.554178Z","title":null,"venue":null,"work_id":"ad148728-988c-44c7-8458-07641295c094","year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.097105Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:ee278ee37e69ce94a2979575a38134bb3e3a3b92ceafd8dac31b1193b4dc7bd4","observation_id":"0fc1a6fe-3494-4a9f-a285-6ed68e1ff0ca","resolution":{"observed_at":"2026-08-08T23:20:01.557747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.100074Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.100074Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:a0210eab6fc5fd3e1efe8acf732e7686d91a7367dbf4560f56484d363487f842","observation_id":"c8be1041-9977-4989-a806-24b9fbe4ec46","resolution":{"observed_at":"2026-08-08T23:20:01.100074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.02252","last_updated":"2021-05-27T15:20:59Z","snapshot_observed_at":"2026-08-07T22:58:49.396675Z","submitted_at":"2020-09-04T15:32:19Z","title":"KILT: a Benchmark for Knowledge Intensive Language Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.02252","snapshot_observed_at":"2026-08-08T23:20:01.103232Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.103232Z"},"links":{"cited_paper":"/paper/2009.02252","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:b5a7f500b30bdd10c6170f46de17fb35420fefe38453a9d7b84b38a6b7fc8649","observation_id":"c985f481-cea8-4282-a398-961788db2fca","resolution":{"observed_at":"2026-08-08T23:20:01.103232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.106544Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.106544Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:6ae0dc899dbf0a163fb1f2d7a28fc53e85c3d7de188bfbd8669800d8a9061182","observation_id":"e0a5ca9b-92e8-480d-a072-a818182179bd","resolution":{"observed_at":"2026-08-08T23:20:01.106544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.533610Z","title":null,"venue":null,"work_id":"f7d22bdf-92ea-4ea3-b4f5-7dc070c018b6","year":2016},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.109555Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:316bdee6e571c41f3b873c9fee02cc6cfc1fd9bd93d3a2fb82bdbe7ea9085d08","observation_id":"83133fca-cc01-4119-8e71-f63612d5c6be","resolution":{"observed_at":"2026-08-08T23:20:01.537255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.114742Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.114742Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:48e08d02c46b3ca9b8cf31746172fafd27995165ce6e28d8ccb424d515e826c3","observation_id":"57c5008e-b476-4b62-9fb6-f77be29fe01d","resolution":{"observed_at":"2026-08-08T23:20:01.114742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.517756Z","title":null,"venue":null,"work_id":"a72d75cf-28cd-4861-a0d7-8467bab16f6b","year":2014},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.134749Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:38aa44d119e7feea5a5737d00ee09cb9c1f42253c687070441b78f7025a24a5a","observation_id":"af5cd519-d9eb-4c80-9d0b-162febbbafab","resolution":{"observed_at":"2026-08-08T23:20:01.521318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.508005Z","title":null,"venue":null,"work_id":"deb72053-5d2d-431a-87c6-0be16e35ea2c","year":2021},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.144101Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:d2c540ce3b4b91613ca32f1300b1ce9a9687023def97711715406887f97a9087","observation_id":"429cb005-0821-4a03-95ce-81894137a3ec","resolution":{"observed_at":"2026-08-08T23:20:01.511211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06039","last_updated":"2021-04-13T09:14:28Z","snapshot_observed_at":"2026-08-07T03:42:41.994347Z","submitted_at":"2021-04-13T09:14:28Z","title":"MultiModalQA: Complex Question Answering over Text, Tables and Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.06039","snapshot_observed_at":"2026-08-08T23:20:01.147309Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.147309Z"},"links":{"cited_paper":"/paper/2104.06039","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:25da2fad83b44a9fc8cf5a7ecac7f71266ebdd2a87899cc8cc3358077f07a03a","observation_id":"e76a441a-6be2-4fd2-8018-275e1a20a3a2","resolution":{"observed_at":"2026-08-08T23:20:01.147309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-08T23:20:01.150915Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.150915Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:ae4a011f77b32cb7cb1de922b3f30b81f5b002fbcfcaacfb0001d69d6f3424b6","observation_id":"284b5d1c-6601-4742-afcd-b27179c33f6c","resolution":{"observed_at":"2026-08-08T23:20:01.150915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18839","last_updated":"2024-09-27T15:35:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T15:35:15Z","title":"MinerU: An Open-Source Solution for Precise Document Content Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18839","snapshot_observed_at":"2026-08-08T23:20:01.154288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.154288Z"},"links":{"cited_paper":"/paper/2409.18839","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:4a0636a6b80c37a84e6bdd5a50562d1039c7d0b9534f6d8c83d613eb6ca849f7","observation_id":"206b83ec-cb7f-455f-9455-002cbebb2d5a","resolution":{"observed_at":"2026-08-08T23:20:01.154288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01319","last_updated":"2024-08-02T15:14:53Z","snapshot_observed_at":"2026-08-07T23:02:26.471823Z","submitted_at":"2024-08-02T15:14:53Z","title":"A Comprehensive Review of Multimodal Large Language Models: Performance and Challenges Across Different Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01319","snapshot_observed_at":"2026-08-08T23:20:01.157567Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.157567Z"},"links":{"cited_paper":"/paper/2408.01319","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:d80766c373e47048f534faee8dd76b4a634ef580e37d178503d742aaf7dad866","observation_id":"604e49ee-fb1b-4dbb-8fb0-555ea65611e1","resolution":{"observed_at":"2026-08-08T23:20:01.157567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-08T23:20:01.160781Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.160781Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:18def31ebb02958a0db662fe1bc0af05208e3a6e2ccd2afaf781b32fdfa55f5d","observation_id":"5c5ebab0-a182-4617-bb2c-9f5bf84c7779","resolution":{"observed_at":"2026-08-08T23:20:01.160781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20434","last_updated":"2025-07-02T15:34:00Z","snapshot_observed_at":"2026-07-06T19:24:39.402031Z","submitted_at":"2024-09-30T15:53:38Z","title":"QAEncoder: Towards Aligned Representation Learning in Question Answering Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20434","snapshot_observed_at":"2026-08-08T23:20:01.164910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.164910Z"},"links":{"cited_paper":"/paper/2409.20434","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:320e6cac1cfdce61ff6c0391879e54d4d8981b597dd9aa1753f0e7af861e57be","observation_id":"9ae03aec-2e88-42e2-bd07-c98ce5106371","resolution":{"observed_at":"2026-08-08T23:20:01.164910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.168526Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.168526Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:a37b5c0e3762d7cdb1b4ab46b3f477ea65942fe0f54db43c35a5d06290aec7c9","observation_id":"fc94833d-d1e8-473c-a940-103a61b5d6e7","resolution":{"observed_at":"2026-08-08T23:20:01.168526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07597","snapshot_observed_at":"2026-08-08T23:20:01.171702Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.171702Z"},"links":{"cited_paper":"/paper/2309.07597","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:9c775227ffe9781962903d2f263dcf1311c8d7d9c58e08d80c52128b3c0e802c","observation_id":"45bda60d-12bd-4e1f-8280-4902184fd413","resolution":{"observed_at":"2026-08-08T23:20:01.171702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00812","last_updated":"2018-09-04T07:04:55Z","snapshot_observed_at":"2026-07-06T06:59:00.071334Z","submitted_at":"2018-09-04T07:04:55Z","title":"RecipeQA: A Challenge Dataset for Multimodal Comprehension of Cooking Recipes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00812","snapshot_observed_at":"2026-08-08T23:20:01.175252Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.175252Z"},"links":{"cited_paper":"/paper/1809.00812","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:4f6826b4a9091e599d0d38a9a7d6e81dcf5fc21f3d43b8e02c1991f97e3e25ee","observation_id":"8e627791-c5cf-4537-8814-86df3d91d9d5","resolution":{"observed_at":"2026-08-08T23:20:01.175252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:20:01.492934Z","title":null,"venue":null,"work_id":"181fdf7a-d957-4e62-82c2-8b50d2d78d63","year":2018},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.178772Z"},"links":{"citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:40f155bd8de4dff4fd71aa0b91f9499742bc27156b267eb91f654e790a630288","observation_id":"a06a6a69-5993-4120-a58d-014782bd304e","resolution":{"observed_at":"2026-08-08T23:20:01.496260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15112","last_updated":"2023-12-14T17:21:39Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:58:20Z","title":"InternLM-XComposer: A Vision-Language Large Model for Advanced Text-image Comprehension and Composition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15112","snapshot_observed_at":"2026-08-08T23:20:01.182050Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.182050Z"},"links":{"cited_paper":"/paper/2309.15112","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:536b2220f4826e073ec9644bab7ec4e490ea1f53ac3373e16211f6fd523c9db3","observation_id":"0d9b605a-cdde-4a1a-88cc-c6fcd128c14f","resolution":{"observed_at":"2026-08-08T23:20:01.182050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-08T23:20:01.185459Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.185459Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:971583d56cbac539b679f5b9b56e8a4f9424a2a6b28157d908b84e61e4bcfe09","observation_id":"80eaf59c-3ff2-4f07-96d2-e354358e12d0","resolution":{"observed_at":"2026-08-08T23:20:01.185459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19473","last_updated":"2024-06-21T08:26:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T18:59:01Z","title":"Retrieval-Augmented Generation for AI-Generated Content: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19473","snapshot_observed_at":"2026-08-08T23:20:01.196499Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.196499Z"},"links":{"cited_paper":"/paper/2402.19473","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:c27840255b4c96f144628d7911f96d3ffb20e92548124f76dda6e9283381a535","observation_id":"d921b454-ad32-4c61-a09f-e6061c90f81f","resolution":{"observed_at":"2026-08-08T23:20:01.196499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01262","last_updated":"2025-03-03T22:45:57Z","snapshot_observed_at":"2026-08-09T02:40:02.382162Z","submitted_at":"2024-08-02T13:35:11Z","title":"RAGEval: Scenario Specific RAG Evaluation Dataset Generation Framework","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01262","snapshot_observed_at":"2026-08-08T23:20:01.200856Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.200856Z"},"links":{"cited_paper":"/paper/2408.01262","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:1f588a11527e6bab0f89fea66c276fcc4a8d49efbbca9e8a56e28338679c1e1b","observation_id":"f0639b5d-90d2-4819-9015-c577a8ec2ade","resolution":{"observed_at":"2026-08-08T23:20:01.200856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08521","last_updated":"2025-02-07T00:09:43Z","snapshot_observed_at":"2026-07-06T19:01:23.623544Z","submitted_at":"2024-08-16T04:32:10Z","title":"MuRAR: A Simple and Effective Multimodal Retrieval and Answer Refinement Framework for Multimodal Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08521","snapshot_observed_at":"2026-08-08T23:20:01.204321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.204321Z"},"links":{"cited_paper":"/paper/2408.08521","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:2cfd7777d2d04f6975b97126a1b7879715ae29b57b5e0e8ea42c2ecb61f1510e","observation_id":"78f6d7f0-f6f5-428e-9a97-16b05588a599","resolution":{"observed_at":"2026-08-08T23:20:01.204321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16365","last_updated":"2025-05-23T14:05:39Z","snapshot_observed_at":"2026-08-03T03:27:56.520381Z","submitted_at":"2024-11-25T13:20:19Z","title":"Multi-modal Retrieval Augmented Multi-modal Generation: Datasets, Evaluation Metrics and Strong Baselines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16365","snapshot_observed_at":"2026-08-08T23:20:01.071133Z","title":"arXiv preprint arXiv:2411.16365 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T23:20:01.071133Z"},"links":{"cited_paper":"/paper/2411.16365","citing_paper":"/paper/2502.04176"},"observation_digest":"sha256:a13bd2f792d5314644231fb2128a15d97746d2d00ffa3e56d2bffa2a00dfa9ff","observation_id":"43159f73-43ff-4c3d-923c-012756fe4084","resolution":{"observed_at":"2026-08-08T23:20:01.071133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.04176","last_updated":"2025-04-21T12:02:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T23:12:59.210731Z","submitted_at":"2025-02-06T16:07:24Z","title":"MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 2 inbound Pith citation observations for arXiv:2502.04176."}