{"as_of":"2026-08-05T03:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41409fb18a93aa5bc8a5292ec3d38752dbd3b491f011e4ecfcea7a2b2189aaf3","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T21:09:26.626179Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T10:54:54.558241Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-20T10:58:14.288775Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"cited_work":{"arxiv_id":"2604.21304","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.21304","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","venue":"cs.IR","work_id":"14f4eefd-ebb0-45c8-99a6-cd597d48a6fa","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":208,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2604.21304","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:ffdc6a8a7539e51a1ebbf998b9fcf02fc3117fdd2e2fb594e32aa5b63473b287","observation_id":"e4f3cd5c-4d9c-4be2-81ed-dac18813f480","resolution":{"observed_at":"2026-05-20T10:58:14.290698Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.21304/citation-record","integrity":"/paper/2604.21304/integrity","json":"/paper/2604.21304/citation-record.json","paper":"/paper/2604.21304"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.16856","last_updated":"2025-06-27T01:14:07Z","snapshot_observed_at":"2026-07-31T17:58:06.926994Z","submitted_at":"2025-03-21T05:02:20Z","title":"MMCR: Benchmarking Cross-Source Reasoning in Scientific Papers","version":2},"cited_work":{"arxiv_id":"2503.16856","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16856","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2503.16856 , year=","venue":null,"work_id":"d9e3e4ae-cd5d-414c-8916-09d4f679db25","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/2503.16856","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:f184f39232b83c2724b8464cf606672e343a5f9716884cfd045de98b6107a234","observation_id":"46a2641c-806f-4a23-b03f-205b14c721a5","resolution":{"observed_at":"2026-05-11T14:41:53.825825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:41:47.943480Z","title":"2023 , html =","venue":null,"work_id":"93ba5ec7-5106-4acd-81ef-d3c29bfac685","year":2023},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:b8c6227256a48f856c01754795b078e66da64e87b03a4f1221d79071516dcf2f","observation_id":"53f19e1b-54ad-423b-9bf5-7344e63cc7e6","resolution":{"observed_at":"2026-05-23T16:18:11.513154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00445","last_updated":"2022-05-01T11:01:28Z","snapshot_observed_at":"2026-07-06T13:05:30.057038Z","submitted_at":"2022-05-01T11:01:28Z","title":"MRKL Systems: A modular, neuro-symbolic architecture that combines large language models, external knowledge sources and discrete reasoning","version":1},"cited_work":{"arxiv_id":"2205.00445","doi":"10.48550/arxiv.2205.00445","metadata_source":"pith","pith_arxiv_id":"2205.00445","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MRKL Systems: A modular, neuro-symbolic architecture that combines large language models, external knowledge sources and discrete reasoning","venue":"cs.CL","work_id":"e393ecfc-aa97-4014-bb7a-90ebd9f00535","year":2022},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/2205.00445","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:e9152613dd2b7b30278dea618c6beab339540e86b626a1c00c65ea27b239e972","observation_id":"9b8cd3de-22c9-4b72-ad36-7dfb638359c6","resolution":{"observed_at":"2026-05-15T07:31:08.404728Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 37th International Conference on Neural Information Processing Systems , articleno =","venue":null,"work_id":"0bcbc2f8-b6e9-4b0e-a1c7-8c3c93dff82c","year":2023},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:6ed178db9a1c06a2306e14c060ff653917756be03d4c2fcb71d96fb91bc29a9e","observation_id":"8d3f7822-cf79-4da0-8722-21ed503d1f11","resolution":{"observed_at":"2026-05-23T16:18:11.428262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"4bd33935-a06d-4c1f-9195-e820a4bc2ca2","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:03483e4adb351277c9aa57db849f71dc641ba988ac6ce1fce451fdf61083476e","observation_id":"141a2fe6-05f1-41b7-a45e-28777a61810a","resolution":{"observed_at":"2026-05-23T16:18:11.414059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1259","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","venue":null,"work_id":"3b7b483f-8a9e-48d0-9c59-bc4a0269ab01","year":2019},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:152dccd60ade7ba7a562ab0d52caac9824ba0267a74185db04db492cca4e2b17","observation_id":"de68e949-ce2f-4575-8fcd-514dc73e75ac","resolution":{"observed_at":"2026-05-09T21:13:24.035725Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-30T11:25:12.65628+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T11:25:12.65628+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07559","last_updated":"2023-12-14T19:40:04Z","snapshot_observed_at":"2026-07-06T17:00:41.729445Z","submitted_at":"2023-12-08T18:50:20Z","title":"PaperQA: Retrieval-Augmented Generative Agent for Scientific Research","version":2},"cited_work":{"arxiv_id":"2312.07559","doi":"10.48550/arxiv.2312.07559","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.07559","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Paperqa: Retrieval-augmented generative agent for scientific research","venue":"arXiv (Cornell University)","work_id":"225eacc5-da70-4566-a2cb-63967c32bb0e","year":2023},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/2312.07559","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:6b069c183afb9a34133a2bbb3c894df384a249681e89da3a1174d039d1bf9841","observation_id":"ba0d5b4d-8fb4-47c4-b1a1-c53e8a2ad49f","resolution":{"observed_at":"2026-05-11T14:41:54.269387Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T01:53:42.089769+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T01:53:42.089769+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"20767c5f-b561-4323-b1cf-ec41559ed774","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:b1391834f9bac82d92074bddd9cd6a63618f8c81d4b5f4bd1d1eb2c9f6de6544","observation_id":"9627780f-6b84-47fb-9eb6-742b4115e5a6","resolution":{"observed_at":"2026-05-23T16:18:11.455450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.904","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M 3 S ci QA : A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models","venue":null,"work_id":"59392995-2f3e-4d1a-9588-24b2112e70d8","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:c04f5677129dbfd4a86283c74e7f867a086bf47a5907e0f29ba29313548f99a7","observation_id":"97540a3c-8421-4ff0-b5c5-af206c1edb1a","resolution":{"observed_at":"2026-05-09T21:13:24.021481Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04952","last_updated":"2024-11-07T18:29:38Z","snapshot_observed_at":"2026-07-06T19:46:54.707852Z","submitted_at":"2024-11-07T18:29:38Z","title":"M3DocRAG: Multi-modal Retrieval is What You Need for Multi-page Multi-document Understanding","version":1},"cited_work":{"arxiv_id":"2411.04952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.04952","snapshot_observed_at":"2026-07-04T12:09:48.864251Z","title":"M3docrag: Multi-modal retrieval is what you need for multi-page multi-document understanding","venue":null,"work_id":"776da489-7ed1-484b-a0a8-4c975ba75e98","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/2411.04952","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:2ad4de7dd912356955ec18e15ec7dba2b897bb9b1abc6392a90e3fb3b9c2c1cf","observation_id":"1bbcf13c-0eae-4fc1-bb61-f7abe1ed8b08","resolution":{"observed_at":"2026-05-11T14:41:54.539181Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"2465e4c3-1635-4ece-8647-360a98907d14","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:f3badbf70807a58cf2f3b166b28e784766afe7d97a8c0a7de9821de60bcfe5d7","observation_id":"c83a5bf8-4e61-41f9-a3e1-473d765c17a0","resolution":{"observed_at":"2026-05-23T16:18:11.488671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.893","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"D oc A gent: An Agentic Framework for Multi-Modal Long-Context Document Understanding","venue":null,"work_id":"0a721d82-ab97-42ea-8ca5-2f00d320a55c","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:86bc05e6068c9a0971eae6c249f947dbe2c4e08a2666ce704ecff099a5fda537","observation_id":"c87c2a54-0e94-4598-ad95-5329d53fba35","resolution":{"observed_at":"2026-05-09T21:13:24.023616Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.1163","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S ci DQA : A Deep Reading Comprehension Dataset over Scientific Papers","venue":null,"work_id":"d33bbc95-a8a7-42de-97cf-ea5a6ee92838","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:cb12a9568f2d39715502d0ddeb1251a76110aeee29ad829ccdd47d12a1a6e718","observation_id":"dddb219b-9982-4589-84bc-68285ca652b4","resolution":{"observed_at":"2026-05-09T21:13:24.025776Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SQuAI: Scientific Question-Answering with Multi-Agent Retrieval-Augmented Generation , year =","venue":null,"work_id":"b1a6443a-9e59-4855-8181-a513e3016f4b","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:437c4297350c577a245770c5bb88d4cfd3a461f1e48253e8c93a4c7dcd33968e","observation_id":"7a087a80-fbb0-4dc4-bba6-28c9cdb6ee1b","resolution":{"observed_at":"2026-05-23T16:18:11.424590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.11633","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Docgenome: An open large- scale scientific document benchmark for training and test- ing multi-modal large language models","venue":null,"work_id":"a1f0b095-dd56-424c-b917-b40bde568c6d","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:0957288ca3e9da23ea7bc03786f563eac5919d1985950c2ea6e9dd1116da09ba","observation_id":"f8b7f3c2-0d07-44dc-bc8e-0a86ef2e81e7","resolution":{"observed_at":"2026-05-11T14:41:54.909380Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scientific Reports , year=","venue":null,"work_id":"52b8fd1e-c821-4bdb-978c-9ada35364fb7","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:bf6231c7f5356f4e55ed7623f1f44726cfab9cc344888f135cf6a0b87a36bb77","observation_id":"9daba706-bfd3-44d2-8565-3dcfa0187c17","resolution":{"observed_at":"2026-05-23T16:18:11.406668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"55ecf98a-fde5-4ad9-90c6-f03d1719406a","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:f2de6f796ae1281e586061b6e6b91fb68207177d7287a681f7cc4ed0c84f1b92","observation_id":"a88082b0-4c86-428e-a4da-9762d5ca55bd","resolution":{"observed_at":"2026-05-23T16:18:11.417757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.199","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SCITAT : A Question Answering Benchmark for Scientific Tables and Text Covering Diverse Reasoning Types","venue":null,"work_id":"1a51a413-f2dc-4bc4-b3af-4bd4c1a86c86","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:92da6d35049e9d7b4a089b933c1c7fffcd7d6b6df08f943b64de1c700d0d90e3","observation_id":"69e8a263-64be-4f79-bfa5-f5b5647826be","resolution":{"observed_at":"2026-05-09T21:13:24.032760Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 40th International Conference on Machine Learning , year=","venue":null,"work_id":"75602ae0-a7d8-4808-949d-09ab8c64af3d","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:0b0070a72f77e780a49669bda0ae934622b6c7f6a8b63d15856d0f480107decc","observation_id":"324c5c4e-ba18-4801-9ccd-bcb865bdcedc","resolution":{"observed_at":"2026-05-23T16:18:11.436691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"e2ec7fba-8057-4da0-9551-2c745d18d314","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:351d9622d0979b9f003c862dfc3e04608592be7b96f15d72450296334401db9a","observation_id":"5820d47d-927e-4e28-a6fb-293ed3c936ca","resolution":{"observed_at":"2026-05-23T16:18:11.440732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.naacl-long.22","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"P eer QA : A Scientific Question Answering Dataset from Peer Reviews","venue":null,"work_id":"e45f126e-dd33-4e84-9544-98c0dbc1969a","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:f6eed01bdad49d1a30ca34f3ffc42e56074fbf66afb24660698340e719c722da","observation_id":"3059b9e6-9fb6-492c-963b-4528b8fde27d","resolution":{"observed_at":"2026-05-09T21:13:24.053015Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.150","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ISBN 979-8-89176-251-0","venue":null,"work_id":"b4123982-f874-458b-aea0-939b0eaa1717","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:a656af5eccf60ddd911ebba5d512affffdb9aff45fe0d79a09f80e1baf07f0bf","observation_id":"dba1fc4b-d086-4ecb-a445-aaac7d6b904b","resolution":{"observed_at":"2026-05-09T21:13:24.050553Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-main.609","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:19:01.905700Z","title":"Fact or Fiction: Verifying Scientific Claims","venue":"Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing (EMNLP)","work_id":"42b71267-506a-4566-811d-87acb366ceba","year":2020},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:e092186611eb79f64ccc6e0d0e4e3fb8b9c4bcf039025a1523e5d3b7dc9a87cb","observation_id":"2c4e9284-b6d0-4bbf-8207-ab4a1b2bc4df","resolution":{"observed_at":"2026-05-09T21:13:24.055658Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T09:20:19.303997+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T09:20:19.303997+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"EMNLP , year=","venue":null,"work_id":"19472d59-f09e-4c9e-b792-3331a4c7ecc5","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:36844276dda21ab83762b3567a2d2934c12447afdedb33251358872bcd3db0d5","observation_id":"a9eded5a-044c-4e29-bb8b-331e3e0f2ac2","resolution":{"observed_at":"2026-05-23T16:18:11.459762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.naacl-main.365","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URLhttps://doi.org/10.18653/v1/2021.naacl-main.365","venue":null,"work_id":"9ba9e026-7faf-4ba3-a311-13b9c2cea30b","year":2021},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:85a21860f52b5b47226d55fd848b8d70820b1ad0a15e8f66c5c72de6e89614a1","observation_id":"95203c37-29c6-478e-8b70-f3461e284fcc","resolution":{"observed_at":"2026-05-09T21:13:24.048285Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-20T23:52:02.638306+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-20T23:52:02.638306+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:12:51.152400Z","title":"AutoGen: Enabling Next-Gen","venue":null,"work_id":"b319c065-33e1-428b-9b36-ecc528a81197","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:2b7019ee6770cd85fc277e4813d7e2370a53bb999a7c384c312a86d1180f7b32","observation_id":"13223644-feef-4d76-b88b-7c48004fc467","resolution":{"observed_at":"2026-05-23T16:18:11.470297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"author =","venue":null,"work_id":"e8bf0b9c-803b-4ba8-acfa-87d5cd109cac","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:eaad7e4470766b4f11a7011cbf38f113feedc565c3f13a366fd32f118919d4ae","observation_id":"c13644c4-dab9-4cc8-b749-ad1a7a4ed836","resolution":{"observed_at":"2026-05-23T16:18:11.474545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:02:58.716193Z","title":"The eleventh international conference on learning representations , year=","venue":null,"work_id":"d0870e7f-a33a-4020-8109-459b41853021","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:40600179c98bc4b29fcb50cf7d09cd9548a8f671040f4542cd1c2406feea1f49","observation_id":"79ee0db5-9365-4c98-a3d1-f88b4464971b","resolution":{"observed_at":"2026-05-23T16:18:11.499408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:00:47.809218Z","title":"2025 , eprint=","venue":null,"work_id":"071bac45-1df3-48cd-b878-63aecfa68d23","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:8030541aa8a14028d403e71214e63cbb3cb317457b2b006710ed05351f17e39d","observation_id":"93592e2b-a5ca-40a5-b6a9-0cfb096db338","resolution":{"observed_at":"2026-05-23T16:18:11.509527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:00:47.805647Z","title":"2024 , eprint=","venue":null,"work_id":"8b1bd1cc-7ec1-4a00-bdb2-7c445801af1f","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:493741224e3da58fdba9c25c0b2a31d0eeebbecd20be7ccf8d6d521a90c67f8f","observation_id":"2e6c59d4-9189-428e-afda-a33d41fe395c","resolution":{"observed_at":"2026-05-23T16:18:11.492050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:00:47.799958Z","title":"2025 , eprint=","venue":null,"work_id":"fc93520b-9888-4599-8859-5a1bb47fcd6b","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:f74370cd3298e6c7220b5454c9403033a1939e79a57de932db865fb4f502c476","observation_id":"de21906c-8242-4011-adba-e7db423ad342","resolution":{"observed_at":"2026-05-23T16:18:11.495536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2026 , eprint=","venue":null,"work_id":"82a33fe1-65d1-40cf-9df6-c365886f728e","year":2026},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:74f41f4cd98f777e8442bb162a231d12f718d92a9f80caae35881fff6cb4b599","observation_id":"b859a663-b6a6-4845-b078-59c79ab53be4","resolution":{"observed_at":"2026-05-23T16:18:11.502517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"f27e33a3-d172-4eb2-9d51-0b237cd39c39","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:567f7962d785735120bce3a15fe3f9b5347cef43deaa5fbe5dd82fe6dc366c96","observation_id":"2de3d62f-593c-4328-96c7-f759253ea115","resolution":{"observed_at":"2026-05-23T16:18:11.485592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:00:47.801635Z","title":"2026 , eprint=","venue":null,"work_id":"b722d05e-02bf-4c2c-a045-22f80da21cc9","year":2026},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:a357f87ee40637e2aef1b66717af5d8c5a7e42bf7d4c6f93d793900659e81a98","observation_id":"375ff912-ec44-478f-9746-10334a915519","resolution":{"observed_at":"2026-05-23T16:18:11.466486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i41.40799","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , author=","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"7d27917a-70b7-4e79-8690-e88e565e698b","year":2026},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:4cecfb895d2cf7dd9b72970d399fad31f26878a4b9320f52873cf68b009f313e","observation_id":"b4e7bb77-ddf9-4e57-a38e-24e8ba0d08e8","resolution":{"observed_at":"2026-05-09T21:13:24.040842Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:00:47.788538Z","title":"2026 , eprint=","venue":null,"work_id":"33974c17-2ffb-42be-b604-d7c0cda93708","year":2026},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:90a45b95d73cca376f0bb2227c86a84ff839d5575d57a98410a6297f6294be99","observation_id":"d7dafc78-4151-4b30-9695-6d0710688840","resolution":{"observed_at":"2026-05-23T16:18:11.463015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:00:47.798004Z","title":"2025 , eprint=","venue":null,"work_id":"648e0471-00bf-4f2a-b24a-15e60a65096b","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:51cde0941edaf80be3fb11e1b0c5125a5563245bbb8bc89242d05808783e3819","observation_id":"9cf19d4d-6853-4292-834c-9567e21fb707","resolution":{"observed_at":"2026-05-23T16:18:11.478242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2026 , eprint=","venue":null,"work_id":"e7249537-308c-45ac-95a3-64fb0605165e","year":2026},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:3f3bdf765c67141fe27f4be4a9efeb8e261a888293cd3cb019c600ff6ab8fe46","observation_id":"2cd4d8e2-4436-4c4c-aab0-2ef90973c9ce","resolution":{"observed_at":"2026-05-23T16:18:11.481900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"a49c2f5f-3d42-43b0-977b-4ab97d5c6bef","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:cc8f017a073b0c8fde529e5d9a1e8264b62b1781b9dbd9b350d8325da886e0f4","observation_id":"97f65ef6-38da-4fb3-93b8-3a9df5748bb8","resolution":{"observed_at":"2026-05-23T16:18:11.448732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:12:51.152096Z","title":null,"venue":null,"work_id":"0dca03ad-8ab3-4bd2-bd14-4c2bf68df285","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:5d3a00bb9572040e90e58d4c5ca8696ff35a2ee54fc21ade818cb0275c48dff0","observation_id":"720c5091-6c6f-4f3b-846b-51229b15e22d","resolution":{"observed_at":"2026-05-23T16:18:11.396395Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4678.353904","doi":"10.1145/3534678.3539041","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Staar, Peter , title =","venue":"Proceedings of the 28th ACM SIGKDD Conference on Knowledge Discovery and Data Mining","work_id":"655b5b8e-69dc-48ab-8032-f7a553c69918","year":2022},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:30128b12d5741f4ff743f4ddbfcf90405e7edbf728ce62ba47b727a5d94b07b1","observation_id":"8aaba336-5b8b-4677-a11a-b744ac728d83","resolution":{"observed_at":"2026-05-09T21:13:24.046083Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:4f16525d948621300f240f0f6692c6d101fb8aea575bfe4561bf5978a3a5e394","observation_id":"c4b8fe5e-2089-456c-b0f5-2e50111db920","resolution":{"observed_at":"2026-05-11T14:41:55.154858Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00075","last_updated":"2019-04-30T19:43:53Z","snapshot_observed_at":"2026-07-06T07:49:38.806531Z","submitted_at":"2019-04-30T19:43:53Z","title":"On the Use of ArXiv as a Dataset","version":1},"cited_work":{"arxiv_id":"1905.00075","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.00075","snapshot_observed_at":"2026-06-30T16:14:53.366075Z","title":"On the Use of ArXiv as a Dataset","venue":"cs.IR","work_id":"4690b353-7ec0-4691-aef4-a115711d022e","year":2019},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/1905.00075","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:4f802fa9057a351b33fc3e7546d7f04503e884a8f1804349987cdc980c915371","observation_id":"d328c1f4-6490-49b2-913e-6f76a26ac216","resolution":{"observed_at":"2026-05-11T14:41:54.765786Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.07920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:30:00.357616Z","title":"Zhang, Z","venue":null,"work_id":"eab51ffa-051f-48d5-8662-042caff09a71","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:bb8284864d539d8e435c9798280110bb05a5c315759150147eb3279c0e150363","observation_id":"b22cd762-7425-41e5-832d-719e8d6f5e86","resolution":{"observed_at":"2026-05-11T14:41:53.935668Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00231","last_updated":"2024-06-02T15:47:16Z","snapshot_observed_at":"2026-07-06T17:37:52.514730Z","submitted_at":"2024-03-01T02:21:30Z","title":"Multimodal ArXiv: A Dataset for Improving Scientific Comprehension of Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2403.00231","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00231","snapshot_observed_at":"2026-07-03T20:48:56.198380Z","title":"Multimodal arxiv: A dataset for improving scientific comprehension of large vision-language models","venue":null,"work_id":"4af8a742-b9ce-48eb-99e6-35eb96332561","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/2403.00231","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:31f4b0d9f9fc014ff0419669a4f1be3cf1c0c1a458c24daa0f684a66219e6e5f","observation_id":"2cf12307-a70e-41da-8af0-c36a875a6a96","resolution":{"observed_at":"2026-05-11T14:41:54.443885Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T14:52:36.596534Z","title":"Claude-3 Model Card , volume=","venue":null,"work_id":"4e64af55-6971-4ec8-ac56-23cded5ad449","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:1a33fa82485e7a4a0de170382792d0748f8a4d8f429c4a24cbed305f95371748","observation_id":"e0b67d88-4b95-46b9-81db-bd425bb1f31b","resolution":{"observed_at":"2026-05-23T16:18:11.392661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:e306d0889b73c3de50133ab8c2c3ef62e1fc91e82f7a72084cd7f846792b35d3","observation_id":"19c2f941-5081-4f00-aa73-a530f813ca46","resolution":{"observed_at":"2026-05-11T14:41:54.099113Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:46:21.705249Z","title":"2024 , eprint=","venue":null,"work_id":"ca5f5ecd-9b5c-411b-8448-7cfb2d5f5eb7","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:2e5c3339f0211f36a5d51a123e90c3838e0dfdd0d717cffcb753ba6bb77716cb","observation_id":"b300b491-7e79-43d1-8661-b5b01430ec3d","resolution":{"observed_at":"2026-05-23T16:18:11.399919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:46:46.775981Z","title":"2025 , eprint=","venue":null,"work_id":"26c7b6ed-f86e-4ed8-b9ed-b1783d90255b","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:a2fa60e68bff2fdccc8097d5b02d88108ec076b9434b843230b2d316f554cb94","observation_id":"fc93264e-8eb1-472a-8ad0-28004753b011","resolution":{"observed_at":"2026-05-23T16:18:11.410559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:06:27.923747Z","title":"2025 , eprint=","venue":null,"work_id":"84936d37-f545-4be1-b6a0-1a704b316615","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:8d5a2caa1787b7718a99cd02e7168aea2c21e119f16aef1c3d43f520b3097d67","observation_id":"645186cf-2f21-4da5-aab7-bc197ad03471","resolution":{"observed_at":"2026-05-23T16:18:11.388191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.153","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:47:48.784249Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","venue":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","work_id":"08362103-dcc9-4e63-948e-05e60dd2d725","year":2023},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:487e8256cd81c2d58ac9855137175ca3a272eaef06cd219532f1808be5eb123f","observation_id":"147d3036-ecba-49d6-90b8-1c6e02dbb9d1","resolution":{"observed_at":"2026-05-09T21:13:24.038294Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:08:48.208433+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:08:48.208433+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.511","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are not fair evaluators","venue":null,"work_id":"019956fb-8a6f-4a29-96f8-323706a1d583","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:7f9ba48ee4fd686b53f80954c4a869844b128eafb538bf45a36e5781ebde1501","observation_id":"e290d9db-733b-40ee-8fdb-81ae5b8bca54","resolution":{"observed_at":"2026-05-09T21:13:24.042721Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:29.593363+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:29.593363+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Zhang, Hao and Gonzalez, Joseph E","venue":null,"work_id":"9d8e3bc4-b921-426a-ae49-8d10948ea5fe","year":2023},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:fd849d3f976a59e0929fca0f6d3187fba2d48f89f65af21575a7d6cad69c72a6","observation_id":"fe7a4b0b-4404-4615-bc13-f361870dc69c","resolution":{"observed_at":"2026-05-23T16:18:11.403377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PDFFigures 2.0: Mining figures from research papers , year=","venue":null,"work_id":"87dbc418-93ea-4028-8927-2986e8beb262","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:39f355869d7db789b0fff70dcae7f219a27da26c5e650b1b3e113f5569143919","observation_id":"476c9413-af3f-44dd-a3cf-b2ff7249e77e","resolution":{"observed_at":"2026-05-23T16:18:11.420797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toolformer: language models can teach themselves to use tools , year =","venue":null,"work_id":"3121be4d-b77d-4f90-894e-1c149ad0c804","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:baeab38d8f0be3db51bec5a4778cc9c0c968df134c3d2019d64742bbb2585ec8","observation_id":"54237905-2490-435c-9ece-12740a36ad87","resolution":{"observed_at":"2026-05-23T16:18:11.432520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:02:58.394367Z","title":"Proceedings of the 40th International Conference on Machine Learning , articleno =","venue":null,"work_id":"aa40350e-22d8-42ba-9ad4-1ce834d45b50","year":2023},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:d348f9231e9eb679defb4696ff0e0986f23b9b2016e0d5c48db6e40d821ca279","observation_id":"d4e29a83-00d9-4ab1-9afb-6b6e764ff6ed","resolution":{"observed_at":"2026-05-23T16:18:11.444614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.775","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal ArXiv: A dataset for improving scientific comprehension of large vision-language models","venue":null,"work_id":"81103747-3ab4-40c3-b07b-e385c8b4e956","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:d5be44a901a03cc551a7d7f9da2f1130700b32ede42841b8ab1bbaf30d5efb04","observation_id":"7c88c490-5df4-437a-93f2-94aca270da30","resolution":{"observed_at":"2026-05-09T21:13:24.030615Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13668","last_updated":"2025-02-19T12:24:46Z","snapshot_observed_at":"2026-07-06T20:39:10.751549Z","submitted_at":"2025-02-19T12:24:46Z","title":"PeerQA: A Scientific Question Answering Dataset from Peer Reviews","version":1},"cited_work":{"arxiv_id":"2502.13668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.13668","snapshot_observed_at":"2026-07-02T15:47:06.783696Z","title":"Wayne C Booth, Gregory G Colomb, and Joseph M Williams","venue":null,"work_id":"21763f1b-e861-445a-b79b-a47161c2959e","year":2009},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"cited_paper":"/paper/2502.13668","citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:7e2c93a9b95a1aa434b0f694c487cebc4183b8c3e979d83983d3f3a6bf23397e","observation_id":"336d0b29-a025-4777-971b-bc0ff62b5260","resolution":{"observed_at":"2026-05-11T14:41:55.266227Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"c0013b51-1b32-4441-a4ef-6bfa874ec8d3","year":null},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:72f8ddadda14e069fbc3317c0c27aa4f55b3043dfc4890026d292806027d1c51","observation_id":"582b4fdc-f9e7-4a14-a6e1-6f9ada859f4e","resolution":{"observed_at":"2026-05-23T16:18:11.452164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , url=","venue":null,"work_id":"26b540c2-42c9-4a0c-8ece-b3bcff319e46","year":2024},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:2d98e1e35ba5e738f043b49ac4326bd039511c2a85dcd714df143a776882f3ad","observation_id":"c2588cef-a207-4d07-90f0-18f1591a9b24","resolution":{"observed_at":"2026-05-23T16:18:11.506335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.sdp-1.18","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S ci VQA 2025: Overview of the First Scientific Visual Question Answering Shared Task","venue":null,"work_id":"1cb292f6-a729-44d9-a864-51dac1a6cef4","year":2025},"citing_paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-09T21:09:26.626179Z"},"links":{"citing_paper":"/paper/2604.21304"},"observation_digest":"sha256:bba2858e5d595b69d60da745b5cdd0771cbebb83852ad31bab12e76de7743135","observation_id":"7e5c9dc7-c8d1-44fc-b453-7e8875b1cb5e","resolution":{"observed_at":"2026-05-09T21:13:24.028015Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.21304","last_updated":"2026-04-27T19:05:57Z","latest_version":2,"primary_category":"cs.IR","snapshot_observed_at":"2026-07-31T15:03:17.391835Z","submitted_at":"2026-04-23T05:42:39Z","title":"PaperMind: Benchmarking Agentic Reasoning and Critique over Scientific Papers in Multimodal LLMs"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":13,"parse_uncertain":0,"unresolved":1,"verified_exact":13,"verified_fuzzy":34},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 1 inbound Pith citation observation for arXiv:2604.21304."}