{"as_of":"2026-08-19T00:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3c746fce4e3dda9ba72bf2e78a2dbb789f0b8b0b870952383f1418b3e3b8075","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:15:39.922529Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12262/citation-record","integrity":"/paper/2608.12262/integrity","json":"/paper/2608.12262/citation-record.json","paper":"/paper/2608.12262"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.608391Z","title":"Minimax m2.5: Built for real-world productivity.https://www.minimax.io/news/minimax-m25, 2026","venue":null,"work_id":"57c2e52b-f835-4115-a31e-5cd333665746","year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.572418Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:8fa28f6e6e2b08939a31e56047dd43ba18f1a0d8abe1d82178fa5c49811ebe9e","observation_id":"d80607f7-35ea-4553-8cf2-7c4ab5546a3d","resolution":{"observed_at":"2026-08-16T00:15:41.613592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-08-16T14:37:33.548231Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-16T00:15:39.578038Z","title":"Kimi k2: Open agentic intelligence.arXiv preprint arXiv:2507.20534, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.578038Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:a0c6c8bf9a309b22cb48ab8807759db39d4a0ba2c86e71f019c597ddca81878e","observation_id":"e889e588-8340-4fc8-9e05-8e9c6e3bbc3e","resolution":{"observed_at":"2026-08-16T00:15:39.578038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-16T00:15:39.583631Z","title":"Glm-5: from vibe coding to agentic engineering.arXiv preprint arXiv:2602.15763, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.583631Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:b4f5487d9db717433f0302a71dbcbefc5a5da6c38ff24527a54c9a3739d85aa7","observation_id":"91bfcf19-7a01-4139-8851-60a9ee3cd505","resolution":{"observed_at":"2026-08-16T00:15:39.583631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.592204Z","title":"Gemini 3.1 pro model card","venue":null,"work_id":"e819c6d3-de84-46e1-aae1-1ce1649f0de7","year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.588673Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:b96d464ac99d8e0c8c4758808d1bbd287ea1de8e84382768aa232edfd4d1f7f6","observation_id":"12acedfc-8068-452e-b80b-ac9bec386994","resolution":{"observed_at":"2026-08-16T00:15:41.597372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.593460Z","title":"Qwen3.5: Towards native multimodal agents.https://qwen.ai/blog?id=qwen3.5, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.593460Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:1525525159148a3ecdde6c8deb2fa58c19d3473dd41f692bfe53196618af1489","observation_id":"c7004987-b145-4158-b912-5a50ce6b6581","resolution":{"observed_at":"2026-08-16T00:15:39.593460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.564503Z","title":"Gpt-5.2.https://developers.openai.com/api/docs/models/gpt-5.2, 2025","venue":null,"work_id":"2cfcbb94-e74f-45d8-9c8b-815668d47448","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.598043Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:f7567d49807392699caca5af05add5f5c130c900430fdaa71f6fa6760181cb24","observation_id":"cd26eb12-d15c-4152-ac53-4e8d8059dde8","resolution":{"observed_at":"2026-08-16T00:15:41.571008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.542591Z","title":"Seed2.0 model card: Towards intelligence frontier for real-world complex- ity","venue":null,"work_id":"7f71b1cc-d1e7-4c52-82bd-376f48f7ef04","year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.603349Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:178b96b8371e8124d18819049055009634750d32346abad0227fc23eaaf46e8e","observation_id":"9856a671-e963-4b42-9e19-9d23012ebb93","resolution":{"observed_at":"2026-08-16T00:15:41.549614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.607763Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmarkforexpertagi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.607763Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:7f82cd3cba016b57bbb27fde434ca01caf63e10b983ce662a0bfe306797a03b4","observation_id":"78c40698-1bd6-41db-b78b-33c8028f9c99","resolution":{"observed_at":"2026-08-16T00:15:39.607763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.613187Z","title":"Mmmu-pro: A more robust multi-discipline multimodal understanding benchmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.613187Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:e3c063a08512125430f370133c07320e3ba9630b19e25d3ceebff3092c2f9123","observation_id":"5b888be3-284f-46c1-8e9d-af6ef5501c70","resolution":{"observed_at":"2026-08-16T00:15:39.613187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.617712Z","title":"Descriptive caption enhancement with visual specialists for multimodal perception.arXiv preprint arXiv:2412.14233, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.617712Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:e4b31a8d77412ac9d5f80483a3ef1becdbf559ad684f60f1e148344faa67451a","observation_id":"5aa9f8ca-72d3-4654-84f4-ce15ca2bc452","resolution":{"observed_at":"2026-08-16T00:15:39.617712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21678","last_updated":"2026-05-02T09:08:51Z","snapshot_observed_at":"2026-08-14T02:21:20.224425Z","submitted_at":"2025-11-26T18:55:08Z","title":"Agentic Learner with Grow-and-Refine Multimodal Semantic Memory","version":2},"cited_work":{"arxiv_id":"2511.21678","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.21678","snapshot_observed_at":"2026-08-16T00:15:40.704313Z","title":"Agentic Learner with Grow-and-Refine Multimodal Semantic Memory","venue":"cs.AI","work_id":"f7cd237a-fd00-4618-9fb4-838a6ad477c9","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.622543Z"},"links":{"cited_paper":"/paper/2511.21678","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:6ef17bb28513767662ec5f63c36922e543f4112453c270efdbf2cd8bee794a24","observation_id":"ecb2f190-97a0-46a3-8f44-435ee32c775f","resolution":{"observed_at":"2026-08-16T00:15:40.710173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.497153Z","title":"Prism.https://openai.com/prism/, 2026","venue":null,"work_id":"6a35cd8a-0c46-4f6f-9063-d199d8409d20","year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.627578Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:79d930862df179032b4f3b4d5d87f79a77602925e25d1740ecb241f2c6a515d1","observation_id":"b766b664-20b7-482e-a68a-83ea7d9ef943","resolution":{"observed_at":"2026-08-16T00:15:41.505957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.632360Z","title":"Charxiv: Charting gaps in realistic chart understanding in multimodal llms.Advances in Neural Information Processing Systems, 37:113569–113697, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.632360Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:186c9ce39c5e5bbb263c7c4233453930771c0b80ab57c01f9829557230890f0d","observation_id":"e55bfb18-cef8-4b81-9c04-bbb7fdc0523b","resolution":{"observed_at":"2026-08-16T00:15:39.632360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.471548Z","title":"Chartmimic: Evaluating lmm’s cross-modal reasoning capability via chart-to-code generation","venue":null,"work_id":"ecd91962-3ab4-4db8-8902-b45ad705ddcf","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.637508Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:76cacb9f4205731f1f0dbcc4812bac49ad62b05274c3ae41b0fdbececfdfb59c","observation_id":"118ab233-a652-4545-8555-be97f0659bb9","resolution":{"observed_at":"2026-08-16T00:15:41.476595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.642020Z","title":"Math blind: Failures in diagram understanding undermine reasoning in mllms.arXiv preprint arXiv:2503.20745, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.642020Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:2e527beb4117893598b730c20c6e47f2e1af8997346bd459e4ef47aae17179f8","observation_id":"78ac8ed7-1bf7-43ba-ac5b-5c66f2b7045d","resolution":{"observed_at":"2026-08-16T00:15:39.642020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09945","last_updated":"2025-08-13T17:00:44Z","snapshot_observed_at":"2026-08-08T00:13:29.644971Z","submitted_at":"2025-08-13T17:00:44Z","title":"VisCodex: Unified Multimodal Code Generation via Merging Vision and Coding Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09945","snapshot_observed_at":"2026-08-16T00:15:39.647053Z","title":"Viscodex: Unified multimodal code generation via merging vision and coding models.arXiv preprint arXiv:2508.09945, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.647053Z"},"links":{"cited_paper":"/paper/2508.09945","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:c1ad26ac43a9bb5e2abbcdcfb7cd2c6cc2ab299f721327dd4c82bdaa166c59a3","observation_id":"9eb404f1-e478-449d-b532-b51214b80c19","resolution":{"observed_at":"2026-08-16T00:15:39.647053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.652257Z","title":"Plot2code: A comprehensive benchmark for evaluating multi-modal large language models in code generation from scientific plots","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.652257Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:bd2725f51423d3deee579b37b41ab809e08a8a95826771101c200943d224a717","observation_id":"627f29a5-7f73-43d0-8205-cfb6ecea7a55","resolution":{"observed_at":"2026-08-16T00:15:39.652257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.444628Z","title":"Starvector: Generating scalable vector graphics code from images and text","venue":null,"work_id":"fed2710e-dcc3-4efb-b348-4a010dcfc8fd","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.657195Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:f84bd09dfca8fdef5a81c3145bd0072f2185dd4013571ef62a1f77addb292e09","observation_id":"9fa5a461-e2e0-4bf8-8b0d-ee536ed42420","resolution":{"observed_at":"2026-08-16T00:15:41.449876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.425436Z","title":"From words to structured visuals: A benchmark and framework for text-to-diagram generation and editing","venue":null,"work_id":"782879ec-f739-4cf8-8d50-ef027934be5c","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.661801Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:d6cc7c1785566afe9da7a5bbb10472ac72a15028508040b12bac1d3e6f7566ad","observation_id":"27bad0f8-84d5-43be-afa9-ecfbda4cc176","resolution":{"observed_at":"2026-08-16T00:15:41.431886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.409799Z","title":"Automatikz: Text-guided synthesis of scientific vector graphics with tikz","venue":null,"work_id":"61f4b71c-0a1f-4739-86b4-fc66001283d4","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.666381Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:cdfcebc751fb8f42b9f0d5d093ad8ee84961d7045f9b55f6fb652bfb076398ce","observation_id":"68919055-2d57-4ef9-8838-19f068d8eb22","resolution":{"observed_at":"2026-08-16T00:15:41.414941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.671003Z","title":"Detikzify: Synthesizing graphics programs for scientific figures and sketches with tikz.Advances in Neural Information Processing Systems, 37:85074–85108, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.671003Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:1d25a8c017c0b1f6dba250e3564674dbb9bd4a873e6ad8f0ed538fb9cd053ba2","observation_id":"4100fe42-185e-429b-b855-552e1e620ab9","resolution":{"observed_at":"2026-08-16T00:15:39.671003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.675973Z","title":"Image2struct: Benchmarking structure extraction for vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.675973Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:c91405aec15bb4f20f84a1c41aedecbd44545c5c9be1995ed7b69d14206f9169","observation_id":"cce8ae06-4ae5-411f-aba3-34a70f198102","resolution":{"observed_at":"2026-08-16T00:15:39.675973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.681348Z","title":"ChartE3: A comprehensive benchmark for end-to-end chart editing.arXiv preprint arXiv:2601.21694, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.681348Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:eacc265f6b9639fc23fd82a216df013c50537776db8329b73526150e800d8c2a","observation_id":"44ca2d26-4614-4efb-ad72-190bf83f56a3","resolution":{"observed_at":"2026-08-16T00:15:39.681348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.371714Z","title":"Chartm3: Benchmarking chart editing with multimodal instructions","venue":null,"work_id":"73377de2-8766-4fee-bdb5-214f1be001a8","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.685529Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:a8b8aa4735e715a6e0d2340b5e4939d3f28a6766e505480282daa8d6766dc45b","observation_id":"2f31694c-99d8-464d-b5a4-22145f7bcbeb","resolution":{"observed_at":"2026-08-16T00:15:41.377034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.689802Z","title":"Chartqa: A benchmark for question answering about charts with visual and logical reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.689802Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:8494aba321bf30b7af9fb1e3d887b4531e59ccb32cddc8e6f49aa07d5f44c92b","observation_id":"47799ae1-3538-45ca-8b4d-ee50c50b55ac","resolution":{"observed_at":"2026-08-16T00:15:39.689802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.344296Z","title":"Can large language models understand symbolic graphics programs? In The Thirteenth International Conference on Learning Representations, 2025","venue":null,"work_id":"0fe11ebe-68d6-422f-b334-90b149985f3c","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.694663Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:702bc98857828a3a27be846a23c85918d918fe0656591b7caa5c3c901950b8fe","observation_id":"906657ac-ad0e-4e3a-b50f-6e140552d99f","resolution":{"observed_at":"2026-08-16T00:15:41.349677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.326728Z","title":"Model context protocol.https://modelcontextprotocol.io, 2024","venue":null,"work_id":"65e8f510-0e95-40fd-9368-0d1313987465","year":2024},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.699186Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:0532e835efbe32cc96a8c226ce5433c4b3f909c89c8c1d71fb95d1e5d3b8dea5","observation_id":"9b6e0e11-7438-48fc-8f18-ad4b916cac8b","resolution":{"observed_at":"2026-08-16T00:15:41.332162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.704342Z","title":"Mmbench: Is your multi-modal model an all-around player? InEuropean conference on computer vision, pages 216–233","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.704342Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:dc1db578a93d1cf6cfb2f134e6e63de777f505cf679cfddffac1407cffd4a6dd","observation_id":"adb876e8-2482-442f-a300-898d1cb856da","resolution":{"observed_at":"2026-08-16T00:15:39.704342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.708688Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.708688Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:f2b79ef450727fbda310e15536010d11cf9ed72dc52615d6dd2c64c152fc4a10","observation_id":"eb2dc289-87d9-4449-8cef-eab14477d585","resolution":{"observed_at":"2026-08-16T00:15:39.708688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.287785Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":"1cdcd48e-2566-450d-84b1-6bf80f805159","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.713386Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:d701d472f53a18dc278061cc23c358c107879eaa245f903157999574f1dfe5a3","observation_id":"8399dc7c-3084-412c-b7c7-4320e4768359","resolution":{"observed_at":"2026-08-16T00:15:41.293156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.718166Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? In European Conference on Computer Vision, pages 169–186","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.718166Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:d4b9ccc482fc5f9c457f694d4a89ec9ada429951f36a0762ba2cbaea49909b74","observation_id":"a5c0f8e2-759a-4af9-af1a-73e2a615659f","resolution":{"observed_at":"2026-08-16T00:15:39.718166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.722752Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.722752Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:68e4bda0299b77b946719fbabf12304167c05c0bc2aa06e33d1d2008d889bb80","observation_id":"4d76f538-3876-475b-bc53-687232117093","resolution":{"observed_at":"2026-08-16T00:15:39.722752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.727088Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.727088Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:e1ba5956d1b60b3822290a719a8f920a4b08d2564e07671ae0fc732b5d48ecd8","observation_id":"1535c572-450f-473c-97af-b9bd62e79a14","resolution":{"observed_at":"2026-08-16T00:15:39.727088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.731529Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.731529Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:787c891a65879eaec5ec97c578d3fc58396e2cb6c652990555291ff49c0cc256","observation_id":"65dece96-550a-446f-ae5f-fe13a0d2b7b6","resolution":{"observed_at":"2026-08-16T00:15:39.731529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.235769Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"50f26078-f56a-4efc-a3f9-88fcaf3dc7be","year":2017},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.736055Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:6160c19261a3f175ae8911cd2d37e2a456fbef95c8a92a57f46fbb28e4faa8d2","observation_id":"3a486471-f273-4622-a5eb-76dc304e773c","resolution":{"observed_at":"2026-08-16T00:15:41.240667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.219516Z","title":"Crystalbleu: precisely and efficiently measuring the similarity of code","venue":null,"work_id":"07b8e075-9226-4742-951b-95333da0d27e","year":2022},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.740234Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:43959329ea8653fbc1f848f9d83e21b326c13ee4857651d1bc2d9f52d36f913a","observation_id":"776a754c-4728-4389-b7d4-855984ac965f","resolution":{"observed_at":"2026-08-16T00:15:41.224514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.744655Z","title":"Worldvqa: Measuring atomic world knowledge in multimodal large language models.arXiv preprint arXiv:2602.02537, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.744655Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:9a4d286d3241c70c567aa1bc070a5c0f3810e57fcf692f36a4a28bcdce8bf49e","observation_id":"ec31a96c-cc8e-4bbd-9539-61214092d765","resolution":{"observed_at":"2026-08-16T00:15:39.744655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.748855Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.748855Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:1d88b8fda7c34ed0abd1602cb0b5ba5382af213c0e069ef6b28d2384f3511864","observation_id":"da202b6f-1da7-4c94-a320-da87c45611fe","resolution":{"observed_at":"2026-08-16T00:15:39.748855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.753185Z","title":"Agentic artificial intelligence (ai): Architectures, taxonomies, and evaluation of large language model agents.arXiv preprint arXiv:2601.12560, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.753185Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:32569f6e2201a450671cf23f71b867e4b51dd4ce2c7eef63998df9bf55fe3e51","observation_id":"4525b63e-b4fa-47cb-a947-b0854873df06","resolution":{"observed_at":"2026-08-16T00:15:39.753185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.193979Z","title":"Ai, agentic models and lab automation for scientific discovery—the beginning of scaince","venue":null,"work_id":"86160981-b63e-439f-9d1a-5d881afa0684","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.757519Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:a53e557ebfd92b7c1c05205bbba0626d84dd545195d4b692bb7cb3e260781a0b","observation_id":"20fa5bf5-9c29-4049-b57c-59e2e4c84f72","resolution":{"observed_at":"2026-08-16T00:15:41.199081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08556","last_updated":"2025-02-12T16:38:40Z","snapshot_observed_at":"2026-08-15T14:56:52.532451Z","submitted_at":"2025-02-12T16:38:40Z","title":"Human-Centric Foundation Models: Perception, Generation and Agentic Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08556","snapshot_observed_at":"2026-08-16T00:15:39.761764Z","title":"Human-centric foundation models: Perception, generation and agentic modeling.arXiv preprint arXiv:2502.08556, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.761764Z"},"links":{"cited_paper":"/paper/2502.08556","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:876e6627efc3865a37496b877c83089400d085ceb14d8cfc548a51f88a1cb31d","observation_id":"d4ae037b-4a79-4418-8c7d-1241c678c697","resolution":{"observed_at":"2026-08-16T00:15:39.761764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06521","last_updated":"2026-07-07T15:04:59Z","snapshot_observed_at":"2026-08-16T10:42:51.653784Z","submitted_at":"2026-01-10T10:42:44Z","title":"BabyVision: Visual Reasoning Beyond Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.06521","snapshot_observed_at":"2026-08-16T00:15:39.766849Z","title":"Babyvision: Visual reasoning beyond language.arXiv preprint arXiv:2601.06521, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.766849Z"},"links":{"cited_paper":"/paper/2601.06521","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:a7338b42e1b48e46bb56f8c95b75724d1ee0c0a456251018658c6fafaff587c0","observation_id":"4069ec4b-08de-4012-854e-4aafb89148dd","resolution":{"observed_at":"2026-08-16T00:15:39.766849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.771870Z","title":"Gemini 3 pro model card.https://storage.googleapis.com/deepmind-media/Model-Cards/ Gemini-3-Pro-Model-Card.pdf, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.771870Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:13fa61f870c1f38509429ae2c58c2da042db2a1051591d137f28de8e2638b677","observation_id":"a9a7d833-6611-467c-8c93-d20e492c8cf8","resolution":{"observed_at":"2026-08-16T00:15:39.771870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.169764Z","title":"Gemini 3 flash model card","venue":null,"work_id":"b1b9275f-8cf6-4900-b5e4-fc044cc4de8c","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.775936Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:80b40401b5b73b49de26907193be0ab153e4db19dfbb41459f983d57dae22a3c","observation_id":"c6a0900a-7ec2-4375-b360-943ad4962b8d","resolution":{"observed_at":"2026-08-16T00:15:41.174621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.780294Z","title":"Claude opus 4.6.https://www.anthropic.com/claude/opus, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.780294Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:55443b03e8825927ca5aa35d6915e3256272573fc5e22d5bc2b64565e16a81b1","observation_id":"4bccfd46-5736-487f-be92-d87d36dd19cc","resolution":{"observed_at":"2026-08-16T00:15:39.780294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-16T00:15:39.784392Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.784392Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:d4848b1981656c1af87c77a3b8fbfdf80157ea64328f8fd1c6152b934b17fb5c","observation_id":"3d9b606d-d181-4a30-b0df-9272f2ed0628","resolution":{"observed_at":"2026-08-16T00:15:39.784392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-08-12T00:25:39.214406Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-08-16T00:15:39.789149Z","title":"Kimi k2.5: Visual agentic intelligence.arXiv preprint arXiv:2602.02276, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.789149Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:0479d4e67e8286bcb0529bf67ddb70fc09ef0ea36988b4b7e3515c1a8b8bd466","observation_id":"cf2cebb7-6387-43b1-8081-714af4a02839","resolution":{"observed_at":"2026-08-16T00:15:39.789149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-16T00:15:39.793874Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.793874Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:ba39c42b9285c0ad8106da1f85aaa83aebfce52a26227428aa8136ae9cfaae05","observation_id":"2e33362e-9e4b-48eb-8d61-b0bf437a81c7","resolution":{"observed_at":"2026-08-16T00:15:39.793874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.798624Z","title":"Tikzero: Zero-shot text-guided graphics program synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.798624Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:d926aa63fd276ee33e7d4979a59b5869e58443ca59847006e07802fa1b30986f","observation_id":"c39d21aa-0f51-4c7f-bfc8-c90ff470228d","resolution":{"observed_at":"2026-08-16T00:15:39.798624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.02865","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.299228Z","title":"Nodes are early, edges are late: Probing diagram representations in large vision-language models.arXiv preprint arXiv:2603.02865, 2026","venue":null,"work_id":"651eff10-c40e-4b41-b727-727321067200","year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.802938Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:d5918f9086ed01fdddb4d1b8b3db49df2ae1fd5ff6b59ba9ccd81cb938af23d4","observation_id":"155c6006-8bfc-41e2-9ae6-349badbec14f","resolution":{"observed_at":"2026-08-16T00:15:40.306779Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.134315Z","title":"Chain-of-region: Visual language models need details for diagram analysis","venue":null,"work_id":"8b27f778-cdbd-47a5-9bc0-bd760f200e43","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.807478Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:f2f41818a470a03f4d517382dc798e856cef58db489700f5ece1fab6e2b23fd3","observation_id":"8e0f18f3-d8a7-4b87-be26-f209824e5eb0","resolution":{"observed_at":"2026-08-16T00:15:41.139634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.117349Z","title":"Challenges and feasibility of multimodal llms in er diagram evaluation","venue":null,"work_id":"98865228-a009-4825-ae59-c063040b358c","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.812314Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:25f688b4239f514d51cf472127c16f94e26dfac386e7cb2e3e02d348dce77d0d","observation_id":"660074a6-494c-4bd1-968d-6a984aa59648","resolution":{"observed_at":"2026-08-16T00:15:41.122193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.101959Z","title":"Ontology-driven multimodal framework for automated interpretation and description of architecture diagrams","venue":null,"work_id":"a47c5e5e-bd1d-4eca-bfa8-bfd5756dc69a","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.816698Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:c1dd3a29aa49f36f38942e70765dac178699f222f8a83124ae7342e7f410132b","observation_id":"70b7d244-4df9-4108-bffb-14ece897e20f","resolution":{"observed_at":"2026-08-16T00:15:41.107152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04389","last_updated":"2025-02-05T23:40:26Z","snapshot_observed_at":"2026-08-18T17:15:29.939893Z","submitted_at":"2025-02-05T23:40:26Z","title":"Overcoming Vision Language Model Challenges in Diagram Understanding: A Proof-of-Concept with XML-Driven Large Language Models Solutions","version":1},"cited_work":{"arxiv_id":"2502.04389","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04389","snapshot_observed_at":"2026-08-16T00:15:40.220668Z","title":"Overcoming Vision Language Model Challenges in Diagram Understanding: A Proof-of-Concept with XML-Driven Large Language Models Solutions","venue":"cs.SE","work_id":"1493a15a-1d54-43c2-8a33-db23ceea6d7c","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.821216Z"},"links":{"cited_paper":"/paper/2502.04389","citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:0d7f866a291d1b00e20ba3c817525afe44392a05025439209386c18758e5f1d3","observation_id":"88db6299-79f1-4f58-bf9d-27f63ae6da70","resolution":{"observed_at":"2026-08-16T00:15:40.227093Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.088298Z","title":null,"venue":null,"work_id":"d0bd66f0-d390-48f7-81d7-41f16c87b6c9","year":2020},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.825999Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:264c46c8d6ed867d0cb586710b4428a789bdf7060c3d02287728b52f2ca92cb7","observation_id":"842428fb-922d-43a6-9f6f-4a1d1b478694","resolution":{"observed_at":"2026-08-16T00:15:41.092751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.072580Z","title":"Editclip: Representation learning for image editing","venue":null,"work_id":"330a914f-0ffa-4c92-8b68-aafbe05be168","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.830532Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:400b7580cdf7d9339489f0171a01d554081b6472bf88a50e87bed171559a5861","observation_id":"57b5b841-6085-407c-8eca-14cd388c747f","resolution":{"observed_at":"2026-08-16T00:15:41.077970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.058426Z","title":"Sketchagent: Generating structured diagrams from hand-drawn sketches","venue":null,"work_id":"d3deba9d-21b6-40c5-924a-bc4070dad366","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.835281Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:92c0b246da5f73f414e6a534aff5397a8af1d2b42090f7b2c30dba05e5b1019a","observation_id":"02cd9bd1-4c4c-4816-982f-06c0f493e22a","resolution":{"observed_at":"2026-08-16T00:15:41.063143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.043879Z","title":"Davinci: Reinforcing visual-structural syntax in mllms for generalized scientific diagram parsing","venue":null,"work_id":"74d57007-1a6c-4c93-8b0c-13de02362e75","year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.839949Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:52ab14ab5e310890d9257b8475f305da2b9c491a7fece7656878ad65fcc9df82","observation_id":"ba70587f-41a6-41ad-ad5a-cd58e09f960d","resolution":{"observed_at":"2026-08-16T00:15:41.049151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.844759Z","title":"Visual autoregressive modeling for instruction-guided image editing.arXiv preprint arXiv:2508.15772, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.844759Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:22063fa69ef202d252dae803961b3fc8fadfcb727685fd8a0f16e0358a2b6502","observation_id":"816f41ca-2524-4641-841f-d462a496e6fe","resolution":{"observed_at":"2026-08-16T00:15:39.844759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.029378Z","title":"Vibe coding as a reconfiguration of intent mediation in software development: Definition, implications, and research agenda","venue":null,"work_id":"1bb5efe9-38bd-44c9-b7b0-c9a2b9253005","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.849183Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:6cace774a12f89c825a9d3c2cac012409a6b669cab8bf317bc4dcd8a3ab51235","observation_id":"a8cc8fff-fd4d-47cd-abdd-a8552c521335","resolution":{"observed_at":"2026-08-16T00:15:41.034361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:39.853657Z","title":"Tikzilla: Scaling text-to-tikz with high-quality data and reinforcement learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.853657Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:c695039c93455046f7c92b5687be3608f29202035a433558d5ad726a140cf175","observation_id":"4ec62e62-c649-4504-b44f-c2a5b405cd88","resolution":{"observed_at":"2026-08-16T00:15:39.853657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:41.014449Z","title":"Mathcoder-vl: Bridging vision and code for enhanced multimodal mathematical reasoning","venue":null,"work_id":"1259389e-6e56-47fd-baa5-9bad49d1cea5","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.858051Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:408c1fe25d92cee7e5acb8340662a6b8218c3dfb13ab4036f6a5c76a60def408","observation_id":"0b75774d-ab27-4065-b74c-870e3d6d533b","resolution":{"observed_at":"2026-08-16T00:15:41.019326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.999065Z","title":"model-in-the-loop","venue":null,"work_id":"5e7be62b-676f-44e2-bff4-2fbcc63a87d5","year":2025},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.862526Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:1e194463be5204f1f0d0f7c21c06b73c64f82dc8681190442e9343925c79081a","observation_id":"e11b5467-029b-483b-bcc5-971a6f4f0064","resolution":{"observed_at":"2026-08-16T00:15:41.003991Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.984992Z","title":null,"venue":null,"work_id":"91e34c1d-db7e-47d1-89c0-6fe04529dc57","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.868955Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:99dd68fe4986de905c3a9bd84d54bc46508d3bf466f6b12b1508a2942182c690","observation_id":"c871679b-e92f-4098-8e8e-1cdc70596e97","resolution":{"observed_at":"2026-08-16T00:15:40.989365Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.968445Z","title":null,"venue":null,"work_id":"67399c2c-e49e-40b9-bc20-27322efe597c","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.873400Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:8c4a2995d30f64c32f25c4c2a0f43b78b9c51db4d714758756a21656561a5262","observation_id":"912540bd-57ad-4d46-bb88-d90ea4daf549","resolution":{"observed_at":"2026-08-16T00:15:40.973515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.952630Z","title":null,"venue":null,"work_id":"1743935c-f234-48d7-b596-615904cc24be","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.877887Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:4c83770fcfde687edf5e730e78618c2c478cde642ef5593b0cf57d6a0b478381","observation_id":"02a3b5a5-cb30-47b2-ad9a-38dd27243ba2","resolution":{"observed_at":"2026-08-16T00:15:40.957877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.923984Z","title":null,"venue":null,"work_id":"117629dc-02e8-47bc-a558-d5c0cacbd252","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.887403Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:e6168eaff86cd583e50bd359e250f089a660c8094285aa551097717151831add","observation_id":"1fb52452-e09a-4548-bb17-3c41421a66a7","resolution":{"observed_at":"2026-08-16T00:15:40.928644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.908867Z","title":null,"venue":null,"work_id":"4540a379-435f-40ad-bba2-ffcd4de77df9","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.891571Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:63271dd8849820e3f8b18823359c64cdbeb3ed1089b4c6b7e2cf3606f1e95426","observation_id":"bd8722c4-358d-4115-a6c0-852361b27eea","resolution":{"observed_at":"2026-08-16T00:15:40.913655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.893828Z","title":"Before writing code, analyze the image systematically","venue":null,"work_id":"636e4556-7429-4f6c-b6cc-4b06e91d4229","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.896041Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:3fbc05e1b6701913c89e25462a8d1ada95b30da188e479836f5e1c215f4d6476","observation_id":"37760ecd-9207-4410-839e-a9a125c89497","resolution":{"observed_at":"2026-08-16T00:15:40.898379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.879168Z","title":"Start from\\documentclassand end with\\end{document}","venue":null,"work_id":"0fb788e8-f0e8-41dc-aa7c-fbaf2c69da0f","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.900356Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:d4592a91af43dcd8531f3bd03dff561c1060a592d66a19249aa42d96cb08c93b","observation_id":"76ce98ef-fe33-4a3d-ae6f-fe8f5d555ece","resolution":{"observed_at":"2026-08-16T00:15:40.883626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.938381Z","title":null,"venue":null,"work_id":"ce6028ab-bbb1-4d76-b5b1-eefce57e2502","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.904716Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:7e60b9d379261b1bbce94228af1ffbeefa0d761e3eaaf6b36339fdde01e1b4c8","observation_id":"758113d0-223a-490a-aa2a-39681bec1417","resolution":{"observed_at":"2026-08-16T00:15:40.943092Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.864262Z","title":null,"venue":null,"work_id":"aa352a9b-c9ad-4d63-a248-1c50e4e0ff38","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.908896Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:8265ceacca5fe2a757a5fc07dfd1a365667f927a30cfee060b6733f693c660a2","observation_id":"5899033b-ec82-440e-9fe7-e8c86d10fa08","resolution":{"observed_at":"2026-08-16T00:15:40.869294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.849222Z","title":null,"venue":null,"work_id":"df993f75-c6f6-4778-9c6c-829c3a366076","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.913162Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:f7eab3c4d44ed5aaed478b8f80c6875a0443c25dcf916618ef37dceef306855e","observation_id":"3b372fa7-c82e-49e2-ba7d-0a5ed1ee6ba6","resolution":{"observed_at":"2026-08-16T00:15:40.853991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.831543Z","title":null,"venue":null,"work_id":"2339f513-ab2c-457b-80dd-09c68d73077a","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.918293Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:5994c962aedb6f02320980049587574a89a6b98142af2eb407af643f17886405","observation_id":"c043988e-5314-424b-9b7b-f0340283c63d","resolution":{"observed_at":"2026-08-16T00:15:40.837530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9432.8854","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:15:40.047595Z","title":"addplot bar chart stacked","venue":null,"work_id":"b9d5a895-a462-42fc-8db1-5c6c6df16eb9","year":null},"citing_paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T00:15:39.922529Z"},"links":{"citing_paper":"/paper/2608.12262"},"observation_digest":"sha256:08afdb8efad65f4f4b26f93e3d9c21f9077ef0dc55fca3952e9274a41d09d54b","observation_id":"b52d8d9b-4671-4a6a-a3f7-581f33b25906","resolution":{"observed_at":"2026-08-16T00:15:40.058214Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.12262","last_updated":"2026-08-12T17:04:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T04:34:32.279897Z","submitted_at":"2026-08-12T17:04:13Z","title":"Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":3,"verified_fuzzy":27},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2608.12262."}