{"as_of":"2026-08-11T22:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eebaeb701fc6b1fdd986e1939ae06e2e1b30c34d8c089c2ef4256dd466df6b5d","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:01:17.216046Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:13:40.295752Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T04:35:57.460732Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20246","snapshot_observed_at":"2026-08-07T00:13:40.295752Z","title":"On path to multimodal historical reasoning: Histbench and histagent.arXiv preprint arXiv:2505.20246, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14728","last_updated":"2025-06-17T17:08:32Z","snapshot_observed_at":"2026-08-07T14:16:24.457276Z","submitted_at":"2025-06-17T17:08:32Z","title":"AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:40.295752Z"},"links":{"cited_paper":"/paper/2505.20246","citing_paper":"/paper/2506.14728"},"observation_digest":"sha256:f289a63332d872f88e46d6cb73dd33b6725f03451bb253027942329a9bad0290","observation_id":"c15b03d3-e3b3-4b99-8f34-2ddb2d552fd8","resolution":{"observed_at":"2026-08-07T00:13:40.295752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"cited_work":{"arxiv_id":"2505.20246","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20246","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.20246 , year=","venue":null,"work_id":"d65dda60-b945-4980-8d05-7eedc9ecb779","year":null},"citing_paper":{"arxiv_id":"2605.07180","last_updated":"2026-05-08T03:18:40Z","snapshot_observed_at":"2026-08-10T21:41:30.191085Z","submitted_at":"2026-05-08T03:18:40Z","title":"Learning Agent Routing From Early Experience","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-11T01:15:07.381414Z"},"links":{"cited_paper":"/paper/2505.20246","citing_paper":"/paper/2605.07180"},"observation_digest":"sha256:6afd417d21723f5a0a9a020c642c79c8fff37d1a88b2110df9389e9ccc633345","observation_id":"ef343a86-5934-47df-9083-f81aaa8f9e99","resolution":{"observed_at":"2026-05-11T04:35:57.472272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20246/citation-record","integrity":"/paper/2505.20246/integrity","json":"/paper/2505.20246/citation-record.json","paper":"/paper/2505.20246"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:14.513303Z","title":"Introducing deep research","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.513303Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:7cc465868de40df44ee859e13ae69292c9268dea3caf6b4b6bad8947725efdca","observation_id":"0bc9837f-444b-466b-b9d6-b2c19eee6362","resolution":{"observed_at":"2026-08-07T14:01:14.513303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18021","last_updated":"2025-08-21T04:15:28Z","snapshot_observed_at":"2026-07-06T18:06:32.549011Z","submitted_at":"2024-04-27T22:59:17Z","title":"CRISPR-GPT for Agentic Automation of Gene-editing Experiments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18021","snapshot_observed_at":"2026-08-07T14:01:14.598967Z","title":"Crispr-gpt: An llm agent for automated design of gene-editing experiments.arXiv preprint arXiv:2404.18021, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.598967Z"},"links":{"cited_paper":"/paper/2404.18021","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:9580a9cbdf472130aa8654439685f53d5c5087433738cbd69912a64de82d7b7a","observation_id":"ec249d02-135e-4c8a-94be-89346ceed14b","resolution":{"observed_at":"2026-08-07T14:01:14.598967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05376","last_updated":"2023-10-02T17:03:01Z","snapshot_observed_at":"2026-08-10T03:24:49.554752Z","submitted_at":"2023-04-11T17:41:13Z","title":"ChemCrow: Augmenting large-language models with chemistry tools","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05376","snapshot_observed_at":"2026-08-07T14:01:14.651275Z","title":"Chemcrow: Augmenting large-language models with chemistry tools.arXiv preprint arXiv:2304.05376, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.651275Z"},"links":{"cited_paper":"/paper/2304.05376","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:94aeb0114ed1b0e5a12b6f900ceb8bd5ebeace634b796e0e409761dc6a0910b4","observation_id":"1fcc7f13-1055-4c6c-a93a-908e0181c6a8","resolution":{"observed_at":"2026-08-07T14:01:14.651275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:14.776357Z","title":"Gaia: a benchmark for general ai assistants","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.776357Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:db7ac1c3b2fc8f59edc76bcb0dba1d541b6195b87ef9ee06bcfe23c420eee917","observation_id":"bff022b5-fac1-43db-8ac3-5894cd89e9c3","resolution":{"observed_at":"2026-08-07T14:01:14.776357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-08-07T14:01:14.869151Z","title":"Humanity’s last exam.arXiv preprint arXiv:2501.14249, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.869151Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:cecafe03b4c6b002fd945e60fd99cd5ffcca75451b9ae899fa83bd4e4dd08a9e","observation_id":"dded0a9d-1a57-45b4-a60e-b403277625fa","resolution":{"observed_at":"2026-08-07T14:01:14.869151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16074","last_updated":"2025-05-18T14:13:34Z","snapshot_observed_at":"2026-08-07T16:00:09.967849Z","submitted_at":"2025-04-22T17:53:29Z","title":"PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16074","snapshot_observed_at":"2026-08-07T14:01:14.955222Z","title":"Phybench: Holistic evaluation of physical perception and reasoning in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.955222Z"},"links":{"cited_paper":"/paper/2504.16074","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:497726860f94dd13adc26d3d22925a00c8c5dd525b0f01ee0b6e193acbae7840","observation_id":"137ad425-18a0-4f6a-bb26-72eb091899c9","resolution":{"observed_at":"2026-08-07T14:01:14.955222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15665","last_updated":"2025-05-11T07:56:18Z","snapshot_observed_at":"2026-07-06T19:36:49.949466Z","submitted_at":"2024-10-21T06:09:30Z","title":"Long Term Memory: The Foundation of AI Self-Evolution","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15665","snapshot_observed_at":"2026-08-07T14:01:15.055708Z","title":"Long term memory: The foundation of ai self-evolution.arXiv preprint arXiv:2410.15665, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.055708Z"},"links":{"cited_paper":"/paper/2410.15665","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:6c86b80539054ec52bbafb015c8dd30f1aa1a974130105c36cb69ffea7d865f1","observation_id":"052beaae-221e-4b94-9dec-c3222f1f3565","resolution":{"observed_at":"2026-08-07T14:01:15.055708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.144453Z","title":"Autoagent: A fully-automated and zero-code framework for llm agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.144453Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:2b01e36ba7aa2a1fb04eefed9ee5f638a526e71025b485181e9d10f3ffd00271","observation_id":"41fb9f62-6e0f-45c4-a92f-08e5d09b5c25","resolution":{"observed_at":"2026-08-07T14:01:15.144453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.217386Z","title":"Owl: Optimized workforce learning for general multi-agent assistance in real-world task automation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.217386Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:7fa1a5d61f2490253afa40da7e3268540fa8306affe5f266f1a5b9346ce08d9a","observation_id":"2e589176-2534-4bf7-9835-e0ec3340c9c8","resolution":{"observed_at":"2026-08-07T14:01:15.217386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.299896Z","title":"‘smo- lagents‘: a smol library to build great agentic systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.299896Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:26b50be5a0f278f7db31c8587c4599d480592a1ee3c72681b6417a960a36040b","observation_id":"61188ccd-d978-4c8a-91d2-bc311452395c","resolution":{"observed_at":"2026-08-07T14:01:15.299896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.396169Z","title":"Towards a holistic framework for multimodal llm in 3d brain ct radiology report generation.Nature Communications, 16(1):2258, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.396169Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:24fd183acc2b8618203d78245fc59b1d0046c38acb39311edbce693634f48af2","observation_id":"aed5eb13-fc05-4cc1-af14-a2aad58a202e","resolution":{"observed_at":"2026-08-07T14:01:15.396169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.490523Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.490523Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:291d7f20805e25a0a60c9a2b916b7aff01b1d4074e0bbe2c82dcafde68934ca1","observation_id":"1339e873-6fd4-42f4-97bc-21df20224e20","resolution":{"observed_at":"2026-08-07T14:01:15.490523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:19.482478Z","title":"Ds-agent: Automated data science by empowering large language models with case-based reasoning, 2024","venue":null,"work_id":"6e1e4e46-205b-40b1-a129-740607426d1e","year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.605895Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:deaee7c8ae98e6ed8e79380b5ab8564361d3580fbcf8aac10c63900f75af4157","observation_id":"82eaa517-4db8-4953-9577-0fc16629916c","resolution":{"observed_at":"2026-08-07T14:01:19.523544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17227","last_updated":"2024-01-30T18:53:30Z","snapshot_observed_at":"2026-08-05T22:06:16.866709Z","submitted_at":"2023-11-28T20:59:49Z","title":"War and Peace (WarAgent): Large Language Model-based Multi-Agent Simulation of World Wars","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17227","snapshot_observed_at":"2026-08-07T14:01:15.697950Z","title":"War and peace (waragent): Large language model-based multi-agent simulation of world wars.arXiv preprint arXiv:2311.17227, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.697950Z"},"links":{"cited_paper":"/paper/2311.17227","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:1096643caadff29bce13d830aa986f62f5cedfd0be2e91f1d757933637f08a80","observation_id":"e5dec6d8-c7b8-411e-bc72-e774d5916df9","resolution":{"observed_at":"2026-08-07T14:01:15.697950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15532","last_updated":"2024-04-23T21:37:22Z","snapshot_observed_at":"2026-08-10T20:20:14.203105Z","submitted_at":"2024-04-23T21:37:22Z","title":"BattleAgent: Multi-modal Dynamic Emulation on Historical Battles to Complement Historical Analysis","version":1},"cited_work":{"arxiv_id":"2404.15532","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.15532","snapshot_observed_at":"2026-08-07T14:01:17.715812Z","title":"BattleAgent: Multi-modal Dynamic Emulation on Historical Battles to Complement Historical Analysis","venue":"cs.HC","work_id":"42cb5e1b-6b64-47bc-801d-f4216d043b5e","year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.830715Z"},"links":{"cited_paper":"/paper/2404.15532","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:5c280bd8a91a63e57ed9cb135a943e240851ca5ada8b60731f4d98703adb0885","observation_id":"3f5be54a-f5d1-4f78-a67d-8f6a89c82a77","resolution":{"observed_at":"2026-08-07T14:01:17.778914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10635","last_updated":"2024-06-28T08:24:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-20T07:01:57Z","title":"SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10635","snapshot_observed_at":"2026-08-07T14:01:15.917999Z","title":"Scibench: Evaluating college-level scientific problem-solving abilities of large language models.arXiv preprint arXiv:2307.10635, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.917999Z"},"links":{"cited_paper":"/paper/2307.10635","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:b88a96d499c31d672d89fd1d7ad8d6107757eeb31d8f8f34fcfa2cfc5d5f5f23","observation_id":"06051994-656c-4d52-82ab-590b59395c6a","resolution":{"observed_at":"2026-08-07T14:01:15.917999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10694","last_updated":"2025-03-12T05:08:02Z","snapshot_observed_at":"2026-08-11T12:30:42.048728Z","submitted_at":"2025-03-12T05:08:02Z","title":"Medical Large Language Model Benchmarks Should Prioritize Construct Validity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10694","snapshot_observed_at":"2026-08-07T14:01:16.031771Z","title":"Medical large language model benchmarks should prioritize construct validity.arXiv preprint arXiv:2503.10694, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.031771Z"},"links":{"cited_paper":"/paper/2503.10694","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:c1f14118f3096cc84a3b6d4f523e7028673ab87e04ea04a977e4a0b7dd03bbfb","observation_id":"fedc3b9d-ed3c-44e5-bcaf-a3b49948bd5c","resolution":{"observed_at":"2026-08-07T14:01:16.031771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11790","last_updated":"2026-06-23T12:36:04Z","snapshot_observed_at":"2026-08-10T17:50:09.184915Z","submitted_at":"2025-01-20T23:41:22Z","title":"Benchmarking LLMs' Mathematical Reasoning with Unseen Random Variables Questions","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11790","snapshot_observed_at":"2026-08-07T14:01:16.103626Z","title":"Benchmarking large language models via random variables.arXiv preprint arXiv:2501.11790, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.103626Z"},"links":{"cited_paper":"/paper/2501.11790","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:0e52f8333e3cb0808b39265b326a2b7a8f071476ae1f0df21b1173bed94d905a","observation_id":"1f5503c1-f13c-4a3d-929b-97409504efe5","resolution":{"observed_at":"2026-08-07T14:01:16.103626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:16.177896Z","title":"Unveiling challenges for llms in enterprise data engineering.arXiv preprint arXiv:2504.10950, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.177896Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:181489fa64173642d54d63135bf76255871a61d498c2818b41c26ddae8b56207","observation_id":"9e66040b-4ca4-4614-ab33-9b986621eaac","resolution":{"observed_at":"2026-08-07T14:01:16.177896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:19.262896Z","title":"Legalbench: A collaboratively built benchmark for measuring legal reasoning in large language models.Advances in Neural Information Processing Systems, 36:44123–44279, 2023","venue":null,"work_id":"551f9764-2d74-4989-a66a-7553fa4e723e","year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.256780Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:fae178fa3f0fcbebd69d15179d696d88b07b5a4cf2250a8158adaf399ea9f934","observation_id":"6d65848d-b5a4-4051-b5cb-89c3f322c66d","resolution":{"observed_at":"2026-08-07T14:01:19.357684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10343","last_updated":"2024-08-19T18:30:18Z","snapshot_observed_at":"2026-08-11T15:37:47.886344Z","submitted_at":"2024-08-19T18:30:18Z","title":"LegalBench-RAG: A Benchmark for Retrieval-Augmented Generation in the Legal Domain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10343","snapshot_observed_at":"2026-08-07T14:01:16.313186Z","title":"Legalbench-rag: A benchmark for retrieval-augmented generation in the legal domain.arXiv preprint arXiv:2408.10343, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.313186Z"},"links":{"cited_paper":"/paper/2408.10343","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:2701fa14217a15afe73f92463a8013c90408752e816bd2a1d1f3de71cfdafa2a","observation_id":"18e5eb42-7114-43be-aef7-8dfc6032a0f5","resolution":{"observed_at":"2026-08-07T14:01:16.313186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-07T14:01:16.367909Z","title":"Swe-bench: Can language models resolve real-world github issues?arXiv preprint arXiv:2310.06770, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.367909Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:1671fc7fa6924c88bc6cdeb913be378968faf4f2df339269298f34c88d7b8d3e","observation_id":"039aba6d-1f2d-4204-9637-a783397a3340","resolution":{"observed_at":"2026-08-07T14:01:16.367909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T14:01:16.420696Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.420696Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:c44b34565cf8711a179b215685d39743107b8ec1e03fce866872ea26df9b3512","observation_id":"b6a0f8ea-6950-42dd-a8dd-061b30a93f90","resolution":{"observed_at":"2026-08-07T14:01:16.420696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T14:01:16.514024Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.514024Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:7816169d60adc234a0eb9faf305d860d295ebe23f2f4200bdc1ea97d4d36629c","observation_id":"314d701d-7ce3-40eb-8ee2-f4679a220815","resolution":{"observed_at":"2026-08-07T14:01:16.514024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06146","last_updated":"2019-09-13T11:18:20Z","snapshot_observed_at":"2026-07-06T08:21:28.880621Z","submitted_at":"2019-09-13T11:18:20Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06146","snapshot_observed_at":"2026-08-07T14:01:16.573108Z","title":"Pubmedqa: A dataset for biomedical research question answering.arXiv preprint arXiv:1909.06146, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.573108Z"},"links":{"cited_paper":"/paper/1909.06146","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:ee4fd9ba32b013398e99e4982500c632b0a1bcfdc23d15d754eceeeee995304f","observation_id":"925a30ba-0be0-4fbe-b55a-cace4ae8cf2b","resolution":{"observed_at":"2026-08-07T14:01:16.573108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:16.633750Z","title":"Large language models encode clinical knowledge.Nature, 620(7972):172–180, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.633750Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:9843976cd684413dcd3de10874f82c13594328a827b3b770e67747348560193f","observation_id":"d6e4bafd-b2c7-4a0c-921a-b57c5e5a760d","resolution":{"observed_at":"2026-08-07T14:01:16.633750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18062","last_updated":"2025-01-30T00:06:55Z","snapshot_observed_at":"2026-08-11T03:07:41.415084Z","submitted_at":"2025-01-30T00:06:55Z","title":"FinanceQA: A Benchmark for Evaluating Financial Analysis Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18062","snapshot_observed_at":"2026-08-07T14:01:16.726294Z","title":"Financeqa: A benchmark for evaluating financial analysis capabilities of large language models.arXiv preprint arXiv:2501.18062, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.726294Z"},"links":{"cited_paper":"/paper/2501.18062","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:c0c450eb51064034d41f9ec7c30054e2b21e849f578a4e3aaf5dee2b95e09bbe","observation_id":"b5cbb368-61f5-41b7-a401-2147d79c0faa","resolution":{"observed_at":"2026-08-07T14:01:16.726294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:19.117622Z","title":"Large language models’ expert-level global history knowledge benchmark (hist-llm).Advances in Neural Information Processing Systems, 37:32336–32369, 2024","venue":null,"work_id":"4b9bc3be-a1f7-417f-bbe6-d41f6358d3ef","year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.788536Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:6e4413a142ca69186899f136c87575f2605c86267dc48ee553bc637d347289ee","observation_id":"c834b617-7112-4e77-8e6f-ff47bcf4b454","resolution":{"observed_at":"2026-08-07T14:01:19.182384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:18.813343Z","title":"Cambridge University Press, 2011","venue":null,"work_id":"a87adc8a-6be1-4543-839d-2eaa9ccbc411","year":2011},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.845207Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:1970daa3103269cfd6a4ce979f6ecb0392c6c51c24cc01a8c357a2dcce60247e","observation_id":"ff58be51-f7af-49ee-9970-5e06909beadf","resolution":{"observed_at":"2026-08-07T14:01:18.974282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:18.492703Z","title":"Arnold.History: A V ery Short Introduction","venue":null,"work_id":"f271d6cb-b9b6-4ef7-84f0-d54e1ceeb377","year":2000},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.909842Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:1e8cd2898c5fe01a9b687690a071bbbe9b6cad4b68840bb78dc73c7d8b521fa2","observation_id":"4e90302a-f514-4dd2-935c-20a9b1182850","resolution":{"observed_at":"2026-08-07T14:01:18.644096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:16.973662Z","title":"Browser use: Enable ai to control your browser, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.973662Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:5d777330a4aae66da0f648a3fed87cc07a14e8669450447a8a3f598b4ee60e61","observation_id":"748a4dff-b3c2-4703-8e6a-37b07328b955","resolution":{"observed_at":"2026-08-07T14:01:16.973662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:01:17.029884Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:17.029884Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:d3944d16f5b5432eb412a2b3ed4152f5ea9674d76f818c2e866ac1cf4af9b01b","observation_id":"b4dcad80-cb48-4bfc-8d71-28c1885a9624","resolution":{"observed_at":"2026-08-07T14:01:17.029884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:01:17.081646Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:17.081646Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:802ac812e031846d7d14e9228908dc03d349e745e20fbaab72c66f12c4ed7aaa","observation_id":"5f67d941-efea-44e2-b30f-00b6fb77dab6","resolution":{"observed_at":"2026-08-07T14:01:17.081646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:18.192868Z","title":"Introducing openai o3 and o4-mini, 2025","venue":null,"work_id":"d01258ee-63c0-4e25-9e69-ccd3065b01bf","year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:17.144534Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:01162fc7b02fe73c99f5e63129f03fee934b49426aaec4e712a39343ea752a52","observation_id":"ac6db4f5-6422-48e3-ac14-9448d91fbf77","resolution":{"observed_at":"2026-08-07T14:01:18.330051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:17.999813Z","title":"Grok 3 beta — the age of reasoning agents, 2025","venue":null,"work_id":"c35dfb4e-4769-4fc2-8580-7db82c0dddc5","year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:17.216046Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:9c760a467b7d929a7632a8cc1816b2875200c22b4438ba45fcd34e348e2b1843","observation_id":"0ba875f7-a853-4e98-a9f6-b4376d1b4d68","resolution":{"observed_at":"2026-08-07T14:01:18.055864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T21:27:49.188739Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 2 inbound Pith citation observations for arXiv:2505.20246."}