{"as_of":"2026-08-08T03:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21d562c54012c03e6d8a64e88341dcaa60c134f7e06524ab868d07a4a5e5a763","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:34.053651Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:48:03.603561Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T00:32:54.660795Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":"2505.24714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finmme: Benchmark dataset for financial multi-modal reasoning evaluation.arXiv preprint arXiv:2505.24714","venue":null,"work_id":"51c89e43-6bdc-47b6-aef5-92174c2f30ec","year":2025},"citing_paper":{"arxiv_id":"2511.14998","last_updated":"2026-04-07T03:13:19Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-19T00:41:14Z","title":"FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T20:19:52.701262Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2511.14998"},"observation_digest":"sha256:5ef9aa3881c151d3456cea6b6b6e2de8ee630af2b25fded274e1190a136a487e","observation_id":"f432e913-cf41-4b9d-acbe-fd43187802aa","resolution":{"observed_at":"2026-05-17T20:20:11.563240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":"2505.24714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finmme: Benchmark dataset for financial multi-modal reasoning evaluation.arXiv preprint arXiv:2505.24714","venue":null,"work_id":"51c89e43-6bdc-47b6-aef5-92174c2f30ec","year":2025},"citing_paper":{"arxiv_id":"2605.06024","last_updated":"2026-05-07T11:17:23Z","snapshot_observed_at":"2026-07-06T23:18:31.432422Z","submitted_at":"2026-05-07T11:17:23Z","title":"Strat-LLM: Stratified Strategy Alignment for LLM-based Stock Trading with Real-time Multi-Source Signals","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T10:42:08.721879Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2605.06024"},"observation_digest":"sha256:b1d19b054a4e32909a4daf1b204b1acbdf3e1927687103866aed39d422a73b23","observation_id":"67bbb98f-4303-4c9a-9bf4-b8765afe70a7","resolution":{"observed_at":"2026-05-11T19:56:08.512517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":"2505.24714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finmme: Benchmark dataset for financial multi-modal reasoning evaluation.arXiv preprint arXiv:2505.24714","venue":null,"work_id":"51c89e43-6bdc-47b6-aef5-92174c2f30ec","year":2025},"citing_paper":{"arxiv_id":"2605.17962","last_updated":"2026-05-18T07:18:01Z","snapshot_observed_at":"2026-08-02T07:15:58.231940Z","submitted_at":"2026-05-18T07:18:01Z","title":"FinDocMRE: A Benchmark for Document-Level Financial Multimodal Reasoning Evaluation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T00:28:48.871454Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2605.17962"},"observation_digest":"sha256:5eda833cfa0d91112a8cc8e12b0ccb3a78eeaf16533e68cf5fb3a8ab51e86739","observation_id":"9629dd8f-8fb5-47aa-bb10-a92f24c2ff51","resolution":{"observed_at":"2026-05-20T00:32:54.664118Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-08-03T00:48:03.603561Z","title":"arXiv preprint arXiv:2505.24714 , doi =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28661","last_updated":"2026-07-22T06:53:07Z","snapshot_observed_at":"2026-08-07T16:52:19.663438Z","submitted_at":"2026-07-22T06:53:07Z","title":"Are the Financial Reasoning from LLMs Credible? A Real World Test over Long-Horizon Statements","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T00:48:03.603561Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2607.28661"},"observation_digest":"sha256:b22ca75351144d54f4a857d7a730ec6e82076dcd49559a5489e5b46c4cd664b6","observation_id":"909eae90-6689-45d6-94bf-624b8d8cd79b","resolution":{"observed_at":"2026-08-03T00:48:03.603561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24714/citation-record","integrity":"/paper/2505.24714/integrity","json":"/paper/2505.24714/citation-record.json","paper":"/paper/2505.24714"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:30.250153Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.250153Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:92f5bd7440ce9e5b201c638571c9bdd0ec0673b604b1e5ce5e4294b6897ecef9","observation_id":"46a9a3f4-bc1b-479c-9f5b-d9650a48eb46","resolution":{"observed_at":"2026-08-07T12:35:30.250153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:30.300258Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.300258Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:f7416ae7de2ad7789df5a2a1e68e7082f61c6d518bff52b767a33b7ebae80337","observation_id":"30626c9e-a431-4b6a-ade8-8bff8cd64751","resolution":{"observed_at":"2026-08-07T12:35:30.300258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T12:35:30.385403Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.385403Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:cf79ae3613ff6cfe7a536bdb25516c8f30dba8d3d1dafc813c74e81f8124de6a","observation_id":"3c9b4a6e-8e04-4a02-b2e1-8392f64ba389","resolution":{"observed_at":"2026-08-07T12:35:30.385403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T12:35:30.451544Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.451544Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:4832206f8d9ce9915adf097775f5046b3ae6d47eabe0dd939d39443fccd2e388","observation_id":"ae996e5e-503d-4314-81d5-d6a4ec8ae4d5","resolution":{"observed_at":"2026-08-07T12:35:30.451544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.563123Z","title":null,"venue":null,"work_id":"e39f5640-4612-4982-a519-0f5b87561235","year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.577706Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:20f9d14934bcf3093cfe497147c6e1e308db0c7eee37a174e1ea1a0cc4c58c4c","observation_id":"b4758da1-1d6f-401b-94bf-f2e350990edb","resolution":{"observed_at":"2026-08-07T12:35:36.636367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.355260Z","title":null,"venue":null,"work_id":"5ecae119-223e-408e-9e1b-8de04df0ff2d","year":2010},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.669831Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:14783f04c8ba811ed19ef6757b5b7ad94d9ca1943be911a18c0c7879aee47048","observation_id":"a096e340-dcb0-43a5-81c2-c4c9c9467ecd","resolution":{"observed_at":"2026-08-07T12:35:36.414991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09980","last_updated":"2024-05-16T10:53:31Z","snapshot_observed_at":"2026-08-06T01:26:02.286688Z","submitted_at":"2024-05-16T10:53:31Z","title":"FinTextQA: A Dataset for Long-form Financial Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09980","snapshot_observed_at":"2026-08-07T12:35:30.786174Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.786174Z"},"links":{"cited_paper":"/paper/2405.09980","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:83fa60ccb231c23b586a01e2a3227920f5f687656bbf6027d75db988ccb8a233","observation_id":"b0e2a5d7-7c2f-4d10-875d-aea697ff2226","resolution":{"observed_at":"2026-08-07T12:35:30.786174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-07T12:35:30.868617Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.868617Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:d58c0015e2bbf8504e1b381a4ef610c3733d8db99a00c613f13f9e0a2aa8e214","observation_id":"1e1b1bab-2e11-48bb-b6bc-8b78c245ef86","resolution":{"observed_at":"2026-08-07T12:35:30.868617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-07T12:35:30.975702Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.975702Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:f8980eac0934937cdd81646216725fad79429c6e15480ff39f27fd8c615f5aeb","observation_id":"8049285d-3b31-4852-aa3d-7f1bc9756a48","resolution":{"observed_at":"2026-08-07T12:35:30.975702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.012295Z","title":null,"venue":null,"work_id":"540e5603-0f17-4bb2-a09b-aab82896d495","year":2022},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.063802Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:e9bc5a1fba9c24d8feccc2f6a746754b4648212b3e5851f05667be86d5de9033","observation_id":"e828c486-00f1-42da-82cd-bf068d589372","resolution":{"observed_at":"2026-08-07T12:35:36.204405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T12:35:31.132886Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.132886Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:9ff9db55a95ad30105240ff7eac1d2de997cd4e39b2d4cae4a2d57e18b6a8732","observation_id":"c0a46116-05ce-42c4-bc55-125d8ee42754","resolution":{"observed_at":"2026-08-07T12:35:31.132886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05211","last_updated":"2025-05-30T12:57:16Z","snapshot_observed_at":"2026-07-06T18:58:56.504337Z","submitted_at":"2024-08-09T17:59:49Z","title":"VITA: Towards Open-Source Interactive Omni Multimodal LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05211","snapshot_observed_at":"2026-08-07T12:35:31.216234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.216234Z"},"links":{"cited_paper":"/paper/2408.05211","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:80f127fa4b48cf43ef0347f564b7f7511cbf2db9b36b3c2dc76d8709aba9d50d","observation_id":"f450c3a2-f6b5-401a-9db7-6da32c58d97d","resolution":{"observed_at":"2026-08-07T12:35:31.216234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01957","last_updated":"2025-10-24T02:32:10Z","snapshot_observed_at":"2026-08-06T10:28:03.148202Z","submitted_at":"2025-01-03T18:59:52Z","title":"VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01957","snapshot_observed_at":"2026-08-07T12:35:31.300260Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.300260Z"},"links":{"cited_paper":"/paper/2501.01957","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:4829693c2b76953b7f4907c57a067b44f7876db989a88fcb3bdb732a766635d1","observation_id":"4b08dc92-9a58-40c5-949b-d6060879c27e","resolution":{"observed_at":"2026-08-07T12:35:31.300260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15296","last_updated":"2024-12-08T04:24:31Z","snapshot_observed_at":"2026-08-07T09:14:56.498818Z","submitted_at":"2024-11-22T18:59:54Z","title":"MME-Survey: A Comprehensive Survey on Evaluation of Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15296","snapshot_observed_at":"2026-08-07T12:35:31.362263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.362263Z"},"links":{"cited_paper":"/paper/2411.15296","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:7b2534b1884ffc2da86d52f6d91ce1e4f2282431c64bd286cabad26bbe4ba6af","observation_id":"f31ac3a0-02af-4b1c-aa28-ff6583550664","resolution":{"observed_at":"2026-08-07T12:35:31.362263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03314","last_updated":"2024-11-05T18:59:51Z","snapshot_observed_at":"2026-08-07T21:25:50.886041Z","submitted_at":"2024-11-05T18:59:51Z","title":"MME-Finance: A Multimodal Finance Benchmark for Expert-level Understanding and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03314","snapshot_observed_at":"2026-08-07T12:35:31.447032Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.447032Z"},"links":{"cited_paper":"/paper/2411.03314","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:6c020bef74dda20d9fadaea809dea4e06fe085d553421ae593482c68ff4b72f4","observation_id":"c2de8741-0ef5-443b-aa22-0d47aaaafa92","resolution":{"observed_at":"2026-08-07T12:35:31.447032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.544870Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.544870Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:2f0f4f8956075f58a8f72d73a3210ca94e43e5336ab7314644fc71cffcc0c299","observation_id":"018c1fa4-a5f3-4832-9495-398357670cb4","resolution":{"observed_at":"2026-08-07T12:35:31.544870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-07T12:35:31.621908Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.621908Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:3d781bdfc34957c0ec2ce216d5d07f1f1230563b385d9d2585c71de19a6c04eb","observation_id":"2ae10eca-e090-40ea-a05c-866acca43fcc","resolution":{"observed_at":"2026-08-07T12:35:31.621908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00468","last_updated":"2025-02-27T15:10:56Z","snapshot_observed_at":"2026-07-06T18:38:59.090751Z","submitted_at":"2024-06-29T15:28:45Z","title":"MMEvalPro: Calibrating Multimodal Benchmarks Towards Trustworthy and Efficient Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00468","snapshot_observed_at":"2026-08-07T12:35:31.673244Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.673244Z"},"links":{"cited_paper":"/paper/2407.00468","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:fed64037d71319ee8c6764c98a9b5fb0ed95b4ca85ec90d32c07ee4fcba5c7c7","observation_id":"43819a59-7a02-4009-b212-5a7a357ef73b","resolution":{"observed_at":"2026-08-07T12:35:31.673244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.753764Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.753764Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:0f44919b71a5da64ac132746eff945f9797f78b67e3640c7c2512f8125ea4ccf","observation_id":"f7924ab8-8164-475b-9820-5429feaa179a","resolution":{"observed_at":"2026-08-07T12:35:31.753764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11944","last_updated":"2023-11-20T17:28:02Z","snapshot_observed_at":"2026-07-06T16:50:06.095609Z","submitted_at":"2023-11-20T17:28:02Z","title":"FinanceBench: A New Benchmark for Financial Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11944","snapshot_observed_at":"2026-08-07T12:35:31.894547Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.894547Z"},"links":{"cited_paper":"/paper/2311.11944","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:71c208da2e261c48fc9a4c37b83d487948b18d1df951c4122a56a7cabf6a72a4","observation_id":"7b19a732-f152-4a6b-91da-508b6892bccd","resolution":{"observed_at":"2026-08-07T12:35:31.894547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05812","last_updated":"2024-05-21T08:37:05Z","snapshot_observed_at":"2026-07-06T16:45:32.248661Z","submitted_at":"2023-11-10T01:12:03Z","title":"CFBenchmark: Chinese Financial Assistant Benchmark for Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05812","snapshot_observed_at":"2026-08-07T12:35:32.015781Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.015781Z"},"links":{"cited_paper":"/paper/2311.05812","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:38997b0a77da200eacda371fe322be66e24a5222835b0ae77739bc7d62744397","observation_id":"d43e62f6-bfd3-4309-a92f-346af62da9ac","resolution":{"observed_at":"2026-08-07T12:35:32.015781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16790","last_updated":"2024-04-25T17:39:35Z","snapshot_observed_at":"2026-08-06T04:28:38.934829Z","submitted_at":"2024-04-25T17:39:35Z","title":"SEED-Bench-2-Plus: Benchmarking Multimodal Large Language Models with Text-Rich Visual Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16790","snapshot_observed_at":"2026-08-07T12:35:32.130801Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.130801Z"},"links":{"cited_paper":"/paper/2404.16790","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:c96d6d4da4c7ce3776946533976c70941e77ecba66f32fb5e72f17341e081582","observation_id":"a6a1a634-b303-4b6e-b6c7-e8b03cf126b3","resolution":{"observed_at":"2026-08-07T12:35:32.130801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-07T12:35:32.258980Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.258980Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:77451e1eeae8aea3883ed62b6f8b26d4f6a74e4d8fec89723435d3d8a15edc42","observation_id":"7ce7526c-13bd-4e7c-9562-7336fb5a67de","resolution":{"observed_at":"2026-08-07T12:35:32.258980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:35.586967Z","title":null,"venue":null,"work_id":"17ff9f63-f25c-460e-8f39-ac533870918c","year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.331654Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:0595d4e0437c3992a5295ee415a4977d6cf34433588da0f5f4db027db1f5324a","observation_id":"ce077ca2-8eea-4988-a970-464b19c96896","resolution":{"observed_at":"2026-08-07T12:35:35.831999Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.03557","last_updated":"2019-08-09T17:57:13Z","snapshot_observed_at":"2026-08-07T01:39:40.489262Z","submitted_at":"2019-08-09T17:57:13Z","title":"VisualBERT: A Simple and Performant Baseline for Vision and Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.03557","snapshot_observed_at":"2026-08-07T12:35:32.435193Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.435193Z"},"links":{"cited_paper":"/paper/1908.03557","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:2a7bcb6056d5aa0e9175a829774fdfad31a4f12a36b77dc6ac4aa6948a6291ad","observation_id":"6230c13c-89c2-4300-ba64-c992c82b2b83","resolution":{"observed_at":"2026-08-07T12:35:32.435193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:32.531062Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.531062Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:1ff8e2a6f448de92ace20f26724c7e65e781539faff69b72c628f5eb973f704f","observation_id":"02595493-e29f-42e0-b415-cde8ecc35ec0","resolution":{"observed_at":"2026-08-07T12:35:32.531062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:32.627555Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.627555Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:3956e01506c12e0198bec9647178cd343c4c08722dc9dc64e0f0a9e5963d9438","observation_id":"fc712e4a-7263-4d74-8a77-eb2b39696964","resolution":{"observed_at":"2026-08-07T12:35:32.627555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:35.263415Z","title":null,"venue":null,"work_id":"0aea6e64-2481-4976-8d5a-36212fad3ae4","year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.733322Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:445d8fd4b26cc9a7cf2536a38c06bd9a806b6f30ef605868dd9565ed15fb7fcf","observation_id":"351ae998-d17c-4a67-a52e-c13e5fa00d65","resolution":{"observed_at":"2026-08-07T12:35:35.416557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10774","last_updated":"2024-04-15T15:48:48Z","snapshot_observed_at":"2026-07-06T16:49:13.099946Z","submitted_at":"2023-11-15T23:36:42Z","title":"MMC: Advancing Multimodal Chart Understanding with Large-scale Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10774","snapshot_observed_at":"2026-08-07T12:35:32.804493Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.804493Z"},"links":{"cited_paper":"/paper/2311.10774","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:dc941f8875fe7e35cf2168acfa3c9dd17347d37527bc074163d214c6d5acfe2f","observation_id":"b77ffe11-d12e-4b0c-bf52-1ce72333bc35","resolution":{"observed_at":"2026-08-07T12:35:32.804493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.970080Z","title":null,"venue":null,"work_id":"ba87793c-2b35-4a3a-b5d9-0ef9d52ae17a","year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.878031Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:b945591985c3768c61cb9d7cb069188f3ff35c9feaf27319e9443a702f2d6e90","observation_id":"765647e4-25e9-4de1-829d-3e45ce599fdf","resolution":{"observed_at":"2026-08-07T12:35:35.082683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21460","last_updated":"2025-03-27T12:50:17Z","snapshot_observed_at":"2026-07-06T20:59:35.694800Z","submitted_at":"2025-03-27T12:50:17Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21460","snapshot_observed_at":"2026-08-07T12:35:32.951314Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.951314Z"},"links":{"cited_paper":"/paper/2503.21460","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:8bb69f55f1bfadd7665943fbf56b481388666ab288ea911c64a0bd959728ab88","observation_id":"1eaefa05-4451-47a2-a956-17b1f11dbf87","resolution":{"observed_at":"2026-08-07T12:35:32.951314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-07T12:35:33.032851Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.032851Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:de435f06c514fb631f1bfe8ac26e0eaa44ac64576522535d61a4ecdf25101e63","observation_id":"c0c17bf7-1135-4f0d-80d9-d471607fb763","resolution":{"observed_at":"2026-08-07T12:35:33.032851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.100252Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.100252Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:3d28224c5b21891124706f6cfe0f18c9fe347ac1895e623131c03dad818cdddb","observation_id":"a649a890-a2ae-41f9-949f-fc4452089ea5","resolution":{"observed_at":"2026-08-07T12:35:33.100252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.694477Z","title":null,"venue":null,"work_id":"aeb52ba2-19cf-4abe-9baa-5d567ea07c4f","year":2020},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.188206Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:66fdc2af9af6ebd6260e9d398509af5c9df9b6d7a47e15fa8140170d7e4f64a8","observation_id":"cdd1da3a-cfd2-4f28-87f5-2a14b13734e3","resolution":{"observed_at":"2026-08-07T12:35:34.794795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.545680Z","title":null,"venue":null,"work_id":"4568ddf8-7542-4688-8bd6-4c926f9b3d73","year":2020},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.295608Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:53e4c0662f8ec36610a79a22fee2685567eed9c24bb1784c47ae22bd8cf0b0e6","observation_id":"8b4dde1d-9671-4586-9790-51849ae05df1","resolution":{"observed_at":"2026-08-07T12:35:34.601957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T12:35:33.363156Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.363156Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:bb71773c45cdf49fa12766738b94166aea3439fc5594bba72a8d6316847e3597","observation_id":"73083d0d-814f-4b9a-8f00-a97cb649ec96","resolution":{"observed_at":"2026-08-07T12:35:33.363156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T12:35:33.424499Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.424499Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:5addba89cf37b3535000363425056bebd0742e6fe23a09b5b3216194180e46c6","observation_id":"d24b0338-a1f2-4828-aa74-2e83e0c92aaa","resolution":{"observed_at":"2026-08-07T12:35:33.424499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-07T12:35:33.482668Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.482668Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:c13e7fc6c40f9e6b58bcb63b061ba38222e6fbc9a0f7a117448eeffc2a69941a","observation_id":"9338ce06-acb8-4c3a-bb8c-256df082e970","resolution":{"observed_at":"2026-08-07T12:35:33.482668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T12:35:33.549590Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.549590Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:61166988c04d7d9f2e43e6dc753c14e998d4b5bae67b87e0d4ed47cdcf58a33f","observation_id":"bb422c51-2059-4a9a-a4db-d8f2096415f7","resolution":{"observed_at":"2026-08-07T12:35:33.549590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12659","last_updated":"2024-06-19T03:38:56Z","snapshot_observed_at":"2026-08-02T08:16:49.760328Z","submitted_at":"2024-02-20T02:16:16Z","title":"FinBen: A Holistic Financial Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12659","snapshot_observed_at":"2026-08-07T12:35:33.646547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.646547Z"},"links":{"cited_paper":"/paper/2402.12659","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:d2cfec8fec5dcc1f7cbc8ca1c07bcb3fe598b6cb7f94050e9d3d0b16a5546bb2","observation_id":"80fd2abe-bd96-4da6-85ee-8b42611c8015","resolution":{"observed_at":"2026-08-07T12:35:33.646547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:35:33.745859Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.745859Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:ffa04fc8138f60f31208eb374b1c33630f7165fe8b14ab0decf74a81e621fcb9","observation_id":"aef175a3-a5cb-4f3d-92c4-6abd39b60f83","resolution":{"observed_at":"2026-08-07T12:35:33.745859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.487143Z","title":null,"venue":null,"work_id":"ac595bab-8299-4ca4-b976-5505b3ef410a","year":2021},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.819813Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:56cb8a9d8ceaa23d72b516a33ecc3660dc5461b64f3f82ec2818bc9166a655ea","observation_id":"801eec10-b278-4453-aa22-7d28771b1e1c","resolution":{"observed_at":"2026-08-07T12:35:34.535561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-06T13:03:19.727877Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-07T12:35:33.911928Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.911928Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:e5b44815b2bc8fb11b25bf601e84504200b2efd921fbb1cb191d03431be06b6f","observation_id":"c696ed45-e664-4492-a530-0ce48ece7a2e","resolution":{"observed_at":"2026-08-07T12:35:33.911928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.972789Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.972789Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:bf1f20fedb46c9d82f3e529c6dc4ddfa4fc4ac24a3fa786082dcd7bff4515f5b","observation_id":"ae8b3625-fc31-4879-9886-38472b69f91b","resolution":{"observed_at":"2026-08-07T12:35:33.972789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.053651Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:34.053651Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:46125ab8a2b6d48427b504227b9f06b634ae498268a232929f93a1f62742ebab","observation_id":"46802361-d266-44d6-b044-e80cf70fa281","resolution":{"observed_at":"2026-08-07T12:35:34.053651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:26:09.635795Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 4 inbound Pith citation observations for arXiv:2505.24714."}