{"as_of":"2026-08-05T02:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bff734d8d72b0415dc3b1bd60f90a0e1739ed1165b3c68406940059f0467900","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:17:18.385882Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2504.19678","last_updated":"2026-03-06T19:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-28T11:08:22Z","title":"From LLM Reasoning to Autonomous AI Agents: A Comprehensive Review","version":2},"reference_index":235,"source":"pdf_text","source_observed_at":"2026-05-15T02:57:37.873567Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2504.19678"},"observation_digest":"sha256:da9be1c9dc034ac93513aece98fdb6276550615d8d498e207a3987f6bbf94b13","observation_id":"1a622c17-1c75-40b4-9ecb-f3448cf8d2a0","resolution":{"observed_at":"2026-05-15T02:57:38.190904Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2507.15736","last_updated":"2026-06-04T10:11:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-21T15:43:05Z","title":"IDRBench: Understanding the Capability of Large Language Models on Interdisciplinary Research","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T03:48:44.217655Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2507.15736"},"observation_digest":"sha256:e8e267ccab973c7fb6d5805245b839a760d92f2fe23d900b184885b892eb040d","observation_id":"5f454d90-f8c8-4364-9ffb-00b377deb460","resolution":{"observed_at":"2026-05-19T03:52:01.581385Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-08-03T05:17:18.385882Z","title":"URL https:// aclanthology.org/2024.tacl-1.9/","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02905","last_updated":"2026-07-10T18:07:40Z","snapshot_observed_at":"2026-08-03T10:58:28.649766Z","submitted_at":"2026-02-02T23:21:13Z","title":"FIRE-Bench: Evaluating AI Agents on the Rediscovery of Scientific Insights","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T05:17:18.385882Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2602.02905"},"observation_digest":"sha256:6ae3b926c3a0751fd34760be422209c85c32c328e30f684f1a209a7496726862","observation_id":"d5f29e90-b949-46ec-9c5c-79d65cf60fb8","resolution":{"observed_at":"2026-08-03T05:17:18.385882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-08-03T02:57:46.930452Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-05T01:09:52.498469Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.930452Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:029bc3f9a67bed72466c1f280d23e8afe677b7249bb9c84db170900422b25985","observation_id":"87d68fee-abb4-4001-ae3f-6ece1f560ad4","resolution":{"observed_at":"2026-08-03T02:57:46.930452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2604.18805","last_updated":"2026-04-20T20:23:42Z","snapshot_observed_at":"2026-08-02T09:17:21.557888Z","submitted_at":"2026-04-20T20:23:42Z","title":"AI scientists produce results without reasoning scientifically","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T03:56:34.581133Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2604.18805"},"observation_digest":"sha256:7ea45765199db70fbebf82009655944cb83f35d7029fde091345f0954beb434e","observation_id":"c836fe18-46e3-40a0-a902-a9541aab91c0","resolution":{"observed_at":"2026-05-11T12:16:06.789382Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2605.05573","last_updated":"2026-05-07T01:36:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-07T01:36:27Z","title":"AstroAlertBench: Evaluating the Accuracy, Reasoning, and Honesty of Multimodal LLMs in Astronomical Classification","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-08T05:23:18.294600Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.05573"},"observation_digest":"sha256:21e3d2d754dbbf50318fe66b5c5d6091f6f6ec4b4151cc0d56b1fcca19f94982","observation_id":"6e5068c3-ca03-403c-95f1-78352ef8f733","resolution":{"observed_at":"2026-05-11T21:31:13.776475Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2605.08678","last_updated":"2026-07-06T13:36:13Z","snapshot_observed_at":"2026-07-31T14:41:52.251938Z","submitted_at":"2026-05-09T04:29:46Z","title":"MLS-Bench: A Holistic and Rigorous Assessment of AI Systems on Building Better AI","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-12T01:13:35.990078Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.08678"},"observation_digest":"sha256:0dbce72cebc26a7ba3c708d25813810b37a4814562c2d56c68fbb658b16bd09c","observation_id":"c412b56e-455c-434d-a41d-c14083931d31","resolution":{"observed_at":"2026-05-12T08:21:25.167029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2605.08678","last_updated":"2026-07-06T13:36:13Z","snapshot_observed_at":"2026-07-31T14:41:52.251938Z","submitted_at":"2026-05-09T04:29:46Z","title":"MLS-Bench: A Holistic and Rigorous Assessment of AI Systems on Building Better AI","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-30T23:12:57.154537Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.08678"},"observation_digest":"sha256:c4a67c3d6b81d0a952d5a397b1da5709b41a6b0d76a60b0ac45c237cc595e2bf","observation_id":"a985dfca-1072-4802-a6a1-9063a0c4f531","resolution":{"observed_at":"2026-07-01T13:25:46.055254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-12T17:14:49.310598Z","title":"Researchbench: Benchmarking llms in scientific discovery via inspiration-based task decomposition.arXiv preprint arXiv:2503.21248, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.08678","last_updated":"2026-07-06T13:36:13Z","snapshot_observed_at":"2026-07-31T14:41:52.251938Z","submitted_at":"2026-05-09T04:29:46Z","title":"MLS-Bench: A Holistic and Rigorous Assessment of AI Systems on Building Better AI","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-12T17:14:49.310598Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.08678"},"observation_digest":"sha256:9d5f491f5bb0c071e37acf61a5148276a75b7dacf8b50f09d820c98298bc3c3d","observation_id":"c7f875f8-afcb-4b52-b7bb-cccf4226276b","resolution":{"observed_at":"2026-07-12T17:14:49.310598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2605.15341","last_updated":"2026-05-14T19:10:45Z","snapshot_observed_at":"2026-07-06T23:26:37.362117Z","submitted_at":"2026-05-14T19:10:45Z","title":"LEAP: Trajectory-Level Evaluation of LLMs in Iterative Scientific Design","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T15:50:01.064709Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.15341"},"observation_digest":"sha256:93c9d1c17b3554a55515def597eca81a235b4d1d6cc207bec47ff8c113884fdd","observation_id":"221c4c7c-b92b-4040-b84f-f23b649768d4","resolution":{"observed_at":"2026-05-19T15:52:38.068813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T05:18:15.358571Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:651ffc918f30553cc938bd7b2eec5a2bf883446719fcf2f0a9dcd982dac8d059","observation_id":"7cdf9a01-c210-4718-b773-a5d5abdedb0a","resolution":{"observed_at":"2026-05-22T05:21:07.442521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-08-02T13:31:44.953243Z","title":"Researchbench: Benchmarking llms in scientific discovery via inspiration-based task decomposition.arXiv preprint arXiv:2503.21248, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.953243Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:33440cccde56568f5ad15f77146aa4fe988a64ee32a36d414cd741630a06e40c","observation_id":"11219177-21d5-4887-b9c5-be5225a21935","resolution":{"observed_at":"2026-08-02T13:31:44.953243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2605.23204","last_updated":"2026-05-22T03:40:30Z","snapshot_observed_at":"2026-07-06T23:33:29.550551Z","submitted_at":"2026-05-22T03:40:30Z","title":"AutoResearch AI: Towards AI-Powered Research Automation for Scientific Discovery","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-25T04:46:43.679185Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.23204"},"observation_digest":"sha256:77f379fa007e5b318388cb3b70afa5c7180ff6e1c2e75faa38b21f8294033586","observation_id":"fcbbcd39-7d85-45c5-90c6-17ffaa4d8414","resolution":{"observed_at":"2026-05-25T04:50:21.922451Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2605.26340","last_updated":"2026-05-25T21:30:27Z","snapshot_observed_at":"2026-07-31T00:39:04.557291Z","submitted_at":"2026-05-25T21:30:27Z","title":"ScientistOne: Towards Human-Level Autonomous Research via Chain-of-Evidence","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-29T21:19:03.281629Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.26340"},"observation_digest":"sha256:64b73cef761fb3a69e4a0b8a45c1f32f0b305e2515c28e3466b956a7e6fcd56c","observation_id":"f8b623b0-94f6-45fb-b711-c763fca21614","resolution":{"observed_at":"2026-06-29T21:23:59.088553Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2606.02258","last_updated":"2026-06-01T13:45:18Z","snapshot_observed_at":"2026-08-02T16:51:34.074966Z","submitted_at":"2026-06-01T13:45:18Z","title":"Matter to Mechanism: A Benchmark for AI Co-Scientists in Materials and Battery Research","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-28T12:08:10.552789Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2606.02258"},"observation_digest":"sha256:f0bf2cee3203ced1d33f0d0211e1df1af269d39562b53485ecf8af7cb95fbfe6","observation_id":"772902d4-0768-428d-a06f-4b1ddf8fb818","resolution":{"observed_at":"2026-06-28T12:12:07.898907Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2606.08532","last_updated":"2026-07-23T07:35:48Z","snapshot_observed_at":"2026-08-02T12:08:54.178991Z","submitted_at":"2026-06-07T09:26:03Z","title":"DN-Hypo-Pipeline: An AI-Driven Workflow for Generating Hypotheses using Large Language Models and Scientific Explanations","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T19:00:15.920341Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2606.08532"},"observation_digest":"sha256:654e9aa285dc85570fa99a24e27be3a38946404338229366d3e33692c9a5e1e1","observation_id":"ca7970c7-2ef8-4d1f-b82a-3c2d6b8fce71","resolution":{"observed_at":"2026-07-02T22:17:26.421873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-08-02T12:09:00.647335Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08532","last_updated":"2026-07-23T07:35:48Z","snapshot_observed_at":"2026-08-02T12:08:54.178991Z","submitted_at":"2026-06-07T09:26:03Z","title":"DN-Hypo-Pipeline: An AI-Driven Workflow for Generating Hypotheses using Large Language Models and Scientific Explanations","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T12:09:00.647335Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2606.08532"},"observation_digest":"sha256:2a7c29cf47faa31b51021309dce75288af00d3fe1c5ba1be06ac0dba6d4c5f74","observation_id":"7465a901-1b6b-4988-b926-d283c48ba0f7","resolution":{"observed_at":"2026-08-02T12:09:00.647335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2606.11926","last_updated":"2026-06-10T10:57:05Z","snapshot_observed_at":"2026-07-06T23:50:53.469137Z","submitted_at":"2026-06-10T10:57:05Z","title":"Toward Generalist Autonomous Research via Hypothesis-Tree Refinement","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-06-27T09:34:41.800309Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2606.11926"},"observation_digest":"sha256:69135dc6bbab14558a087c0415a1dc596f7a2def85fc9bd1e7c4f636a9c669d9","observation_id":"7617b107-6444-487f-af8a-02423656c2e5","resolution":{"observed_at":"2026-07-03T11:28:04.228018Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":"2503.21248","doi":"10.48550/arxiv.2503.21248","metadata_source":"pith","pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","venue":"cs.CL","work_id":"f9ffa616-6934-4c6d-98bd-888acc000aaa","year":2025},"citing_paper":{"arxiv_id":"2607.01233","last_updated":"2026-07-01T17:59:56Z","snapshot_observed_at":"2026-07-07T00:06:49.412663Z","submitted_at":"2026-07-01T17:59:56Z","title":"Measuring the Gap Between Human and LLM Research Ideas","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-02T12:22:54.748120Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2607.01233"},"observation_digest":"sha256:4b7b3b351f97e5f5b4ec1fb883cfb62904183c8d1d093b79d7b01f5696118bd3","observation_id":"ff822da0-cba6-43d1-ba64-c14e416634ec","resolution":{"observed_at":"2026-07-02T12:26:56.105887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-11T20:19:27.650696Z","title":"Researchbench: Benchmarking llms in scientific discovery via inspiration-based task decomposition.arXiv preprint arXiv:2503.21248, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04293","last_updated":"2026-07-05T13:08:51Z","snapshot_observed_at":"2026-07-11T20:19:25.987601Z","submitted_at":"2026-07-05T13:08:51Z","title":"CausalGame: Benchmarking Causal Thinking of LLM Agents in Games","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T20:19:27.650696Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2607.04293"},"observation_digest":"sha256:b1629da390b3a74b5c6426267d101668fd3c4688e4274740daf384909000c5ae","observation_id":"9e5c07ea-8d73-4a72-ad22-c6ba4b08073a","resolution":{"observed_at":"2026-07-11T20:19:27.650696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-07-11T19:11:37.739920Z","title":"Researchbench: Benchmarking LLMs in scientific discovery via inspiration- based task decomposition, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04439","last_updated":"2026-07-05T17:59:43Z","snapshot_observed_at":"2026-07-11T19:11:36.152412Z","submitted_at":"2026-07-05T17:59:43Z","title":"ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T19:11:37.739920Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2607.04439"},"observation_digest":"sha256:d69c4c9466754e654c2aa68ecdac493d981d453e8c68295845231c19833160f9","observation_id":"5e3cc368-8abf-45fc-92aa-83f6af3c85c2","resolution":{"observed_at":"2026-07-11T19:11:37.739920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.21248/citation-record","integrity":"/paper/2503.21248/integrity","json":"/paper/2503.21248/citation-record.json","paper":"/paper/2503.21248"},"outbound":[],"paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2503.21248."}