{"as_of":"2026-08-05T12:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:88b3684459df0c98443066a5195de4f8b660df61203f5475a3765d5cdbe1e13b","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T04:22:42.678252Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T21:25:09.477066Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-02T21:25:09.477066Z","title":"ISBN 979-8-89176-189-6","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.20459","last_updated":"2026-07-02T01:11:49Z","snapshot_observed_at":"2026-08-02T21:25:07.319126Z","submitted_at":"2026-02-24T01:37:53Z","title":"PreScience: A Dataset and Benchmark for Scientific Forecasting","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T21:25:09.477066Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2602.20459"},"observation_digest":"sha256:1a6c656bc732b1457ab037165331d295c2765da3b1e19777507fe17654c0540f","observation_id":"d5c0ccbd-8396-45a7-8c34-8cd9a34c1c04","resolution":{"observed_at":"2026-08-02T21:25:09.477066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2604.18805","last_updated":"2026-04-20T20:23:42Z","snapshot_observed_at":"2026-08-02T09:17:21.557888Z","submitted_at":"2026-04-20T20:23:42Z","title":"AI scientists produce results without reasoning scientifically","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T03:56:34.581133Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2604.18805"},"observation_digest":"sha256:99adea5b1a3c30e3ee14701adbad84319b1fe00b41f37ffff67fda23dd938746","observation_id":"a7eb9c78-9241-445f-be4d-81de32f67aa4","resolution":{"observed_at":"2026-05-11T12:16:06.945351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2605.06607","last_updated":"2026-05-12T22:57:53Z","snapshot_observed_at":"2026-07-06T23:19:00.794334Z","submitted_at":"2026-05-07T17:27:23Z","title":"AI CFD Scientist: Toward Open-Ended Computational Fluid Dynamics Discovery with Physics-Aware AI Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T05:49:04.698675Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.06607"},"observation_digest":"sha256:228176974d7c0c662a9da1fa9927ad336e8d34da845fb018c9f3c36bd9f8591c","observation_id":"3931dd99-fc0e-44e7-8bfb-f87edf1f00a8","resolution":{"observed_at":"2026-05-08T23:34:25.594065Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2605.06607","last_updated":"2026-05-12T22:57:53Z","snapshot_observed_at":"2026-07-06T23:19:00.794334Z","submitted_at":"2026-05-07T17:27:23Z","title":"AI CFD Scientist: Toward Open-Ended Computational Fluid Dynamics Discovery with Physics-Aware AI Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T02:05:57.854868Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.06607"},"observation_digest":"sha256:7ed29158703d5f9078d0ac746f806a878789ac7c33c68dc5e34deac3ba3544a7","observation_id":"751183ca-425c-4d24-9b80-96a4b48bc67a","resolution":{"observed_at":"2026-05-11T02:10:53.291670Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2605.06607","last_updated":"2026-05-12T22:57:53Z","snapshot_observed_at":"2026-07-06T23:19:00.794334Z","submitted_at":"2026-05-07T17:27:23Z","title":"AI CFD Scientist: Toward Open-Ended Computational Fluid Dynamics Discovery with Physics-Aware AI Agents","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-14T22:02:47.160731Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.06607"},"observation_digest":"sha256:fbf79bb8076a5e7393a34c250d1aebefa0a52ac32d2c77aef14c62cf806d5cb1","observation_id":"6e225598-4033-49a3-abdf-a7b61cae103e","resolution":{"observed_at":"2026-05-14T22:03:01.680124Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2605.08678","last_updated":"2026-07-06T13:36:13Z","snapshot_observed_at":"2026-07-31T14:41:52.251938Z","submitted_at":"2026-05-09T04:29:46Z","title":"MLS-Bench: A Holistic and Rigorous Assessment of AI Systems on Building Better AI","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T01:13:35.990078Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.08678"},"observation_digest":"sha256:731831de1d0cfece4bd525d33e8fab1e5f55155ad86af1375458e51197ca1c28","observation_id":"e7e074c1-2e13-44a5-8339-3e1ca933f3de","resolution":{"observed_at":"2026-05-12T08:21:25.340194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2605.08678","last_updated":"2026-07-06T13:36:13Z","snapshot_observed_at":"2026-07-31T14:41:52.251938Z","submitted_at":"2026-05-09T04:29:46Z","title":"MLS-Bench: A Holistic and Rigorous Assessment of AI Systems on Building Better AI","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T23:12:57.154537Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.08678"},"observation_digest":"sha256:a1ada135b35a7d1315a3d8b7ff5cf31cb7927dfc3c7f8168a2390bef4a33fc65","observation_id":"11768a4e-2ae1-4eb7-b31e-72e1e0c2486f","resolution":{"observed_at":"2026-07-01T13:25:45.941705Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-07-12T17:14:49.310598Z","title":"Hwang, Peter A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.08678","last_updated":"2026-07-06T13:36:13Z","snapshot_observed_at":"2026-07-31T14:41:52.251938Z","submitted_at":"2026-05-09T04:29:46Z","title":"MLS-Bench: A Holistic and Rigorous Assessment of AI Systems on Building Better AI","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T17:14:49.310598Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.08678"},"observation_digest":"sha256:2fb729e3825808c0428cc046cc9e06f53dc22730a6673ae86708a3d8ec3d5005","observation_id":"8cfb608a-f57c-4960-b6bd-d9b1a12b4dca","resolution":{"observed_at":"2026-07-12T17:14:49.310598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2605.10820","last_updated":"2026-05-11T16:37:19Z","snapshot_observed_at":"2026-07-06T23:22:42.512039Z","submitted_at":"2026-05-11T16:37:19Z","title":"MaD Physics: Evaluating information seeking under constraints in physical environments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:34.339865Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.10820"},"observation_digest":"sha256:80a740a51cb64f232fa11308c55b3b691569c0fe730c8646f1097992fbb4cf8d","observation_id":"075f0ff9-b21d-4c36-83af-e30a3618fd36","resolution":{"observed_at":"2026-05-12T06:51:29.429812Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2605.14355","last_updated":"2026-05-14T04:30:49Z","snapshot_observed_at":"2026-08-03T03:55:27.049390Z","submitted_at":"2026-05-14T04:30:49Z","title":"Herculean: An Agentic Benchmark for Financial Intelligence","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T21:06:46.156943Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.14355"},"observation_digest":"sha256:c5eb89961a2f1bd170b573418ccffb23e42e66599a2e334660939db85913db03","observation_id":"4697949c-fbb7-48a7-b1d2-da6786ec6552","resolution":{"observed_at":"2026-06-30T21:15:04.700274Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2605.28655","last_updated":"2026-05-27T15:56:12Z","snapshot_observed_at":"2026-07-06T23:38:14.056361Z","submitted_at":"2026-05-27T15:56:12Z","title":"AutoScientists: Self-Organizing Agent Teams for Long-Running Scientific Experimentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T12:39:00.460842Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2605.28655"},"observation_digest":"sha256:8d391cb234ca8e127b52b9fce776f92d1bd072eb08404d14569c3bcd98bf6310","observation_id":"af7d43de-8690-4abe-9f60-e285dab7a0ab","resolution":{"observed_at":"2026-06-29T12:43:25.737888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:c7970d441484bfd5b8aeef11718c89018ed0e98e546d49a6492c14b9a9ac418c","observation_id":"56092da5-4202-4570-9163-10b947328fdd","resolution":{"observed_at":"2026-07-03T11:28:04.310517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2606.26346","last_updated":"2026-06-24T19:38:21Z","snapshot_observed_at":"2026-08-01T10:31:00.655586Z","submitted_at":"2026-06-24T19:38:21Z","title":"How Do Tool-Augmented LLM Agents Perform on Real-World Energy Analytics Tasks?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T01:34:10.103638Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2606.26346"},"observation_digest":"sha256:ba58c1d13ef08dd61729833542d37e9f6d1ec402746f4cfb5d2a381b3b8feb33","observation_id":"322c6cf9-a886-4744-9d94-bcc59f2dcb3c","resolution":{"observed_at":"2026-07-04T15:29:56.690048Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-01T01:16:39.660640Z","title":"arXiv preprint arXiv:2510.21652 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25891","last_updated":"2026-07-28T15:50:19Z","snapshot_observed_at":"2026-08-03T13:33:54.988164Z","submitted_at":"2026-07-28T15:50:19Z","title":"Messier: A High-Resolution Corpus for Cross-Benchmark Agent Evaluation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T01:16:39.660640Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2607.25891"},"observation_digest":"sha256:98f53f13fbbd87ddbaa5dab03f9ae1cc29e821c1ce226c630255e92d81e9d7df","observation_id":"ade5ab9e-ec58-4f31-92c9-b4da01308258","resolution":{"observed_at":"2026-08-01T01:16:39.660640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-01T05:48:17.552942Z","title":"Astabench: Rigorous benchmarking of ai agents with a scientific research suite.arXiv preprint arXiv:2510.21652, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27556","last_updated":"2026-07-30T01:00:36Z","snapshot_observed_at":"2026-08-04T16:33:36.344924Z","submitted_at":"2026-07-30T01:00:36Z","title":"Evaluating Agentic Bioinformatics through Function, Evidence, and Validation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T05:48:17.552942Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2607.27556"},"observation_digest":"sha256:639733a2855c8c115b617e0ccb31dc18cac13322ff881c4ad1399a5ad1747339","observation_id":"ff84bb64-1668-4bd9-bb36-e454e9ef485c","resolution":{"observed_at":"2026-08-01T05:48:17.552942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2510.21652/citation-record","integrity":"/paper/2510.21652/integrity","json":"/paper/2510.21652/citation-record.json","paper":"/paper/2510.21652"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24785","last_updated":"2025-06-02T01:59:50Z","snapshot_observed_at":"2026-07-06T21:33:50.814913Z","submitted_at":"2025-05-30T16:46:29Z","title":"EXP-Bench: Can AI Conduct AI Research Experiments?","version":2},"cited_work":{"arxiv_id":"2505.24785","doi":"10.48550/arxiv.2505.24785","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24785","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exp-bench: Can ai conduct ai research experiments?","venue":"arXiv (Cornell University)","work_id":"37455c23-0127-444d-b7df-c4a5cfbe5601","year":2025},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"cited_paper":"/paper/2505.24785","citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:4687207a6efaf85e912488d7c0f0c76c8f6aa5828976a90e271be3d9c1212907","observation_id":"009a013c-5b33-421d-954b-5d6fae5e99c6","resolution":{"observed_at":"2026-05-18T04:25:52.289457Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12937","last_updated":"2025-08-21T20:28:50Z","snapshot_observed_at":"2026-07-06T21:42:34.660604Z","submitted_at":"2025-06-15T18:41:23Z","title":"HypER: Literature-grounded Hypothesis Generation and Distillation with Provenance","version":2},"cited_work":{"arxiv_id":"2506.12937","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12937","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vector Institute","venue":null,"work_id":"02516b98-e822-4ed5-8e53-536887306024","year":2025},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"cited_paper":"/paper/2506.12937","citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:d8bc87c064c07182867dfd142e06cfea254ff228b813e84a5cbed1a2bf440ed2","observation_id":"f179ae13-794e-4b09-a41b-1a07b0744809","resolution":{"observed_at":"2026-05-18T04:25:52.295619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fcf9fe5c-8051-480e-bda9-e019b90fd669","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:2183c06fb30fccd75f264b694b2a01bfa1bd73c20ac3527fccfc554178363454","observation_id":"3b462d4d-4df2-49b9-8cc4-041c33e82ba4","resolution":{"observed_at":"2026-05-18T04:25:53.054463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"At the same time, the environment and tools must be standard and reproducible to facilitate controlled comparison across different agents","venue":null,"work_id":"61f2d1c9-ddd8-457a-ae73-07423f318328","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:aa005d43ceb7755c3c6dd8f9ccc35f8127418b18364727b95b2f3231fe94c37e","observation_id":"ef0d47dd-7d19-420b-9847-146c5627e742","resolution":{"observed_at":"2026-05-18T04:25:53.031290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e2c809f4-f7ff-456c-84f5-941d01f4adc1","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:024698d063d0d2a279e9a3f9ca3514060a9dfa756c786b06937a3870cc3731e4","observation_id":"d33642b8-0f58-48cd-bcfd-dc1dcd3cd867","resolution":{"observed_at":"2026-05-18T04:25:52.994448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O” denotes Openness, with values✓ (Open-source, open-weight), ∼ (Open-source, closed-weight), A (Closed source & API available), and × (Closed & UI only). “T","venue":null,"work_id":"dccebb17-673e-4db9-8afc-6c2761dad0a5","year":1933},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:06addbb1e05d11b6ff0e090629ae108200ce1aea69f6df3a5e8f07ade945a220","observation_id":"dbcde467-0e5b-4329-a9c1-e561fb2a97ce","resolution":{"observed_at":"2026-05-18T04:25:52.892972Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"acde8969-fdc8-42df-81f9-e86df3657079","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:4b01391f8453e706c9cd022397e0e10fed6869fb2de71ac7c2abaacfd0adc7f2","observation_id":"77303eec-938b-472a-8244-dd4d6f58b5ba","resolution":{"observed_at":"2026-05-18T04:25:53.041687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c3be4bdc-f93c-4c4e-b425-bc2fe777ba3a","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:5dbdb049047504e013fa94cd81c08771b435016c4ca6f94f801048ac9cf853f2","observation_id":"6731194a-d929-48b0-aca3-6b38805d2d6c","resolution":{"observed_at":"2026-05-18T04:25:53.027586Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n18-3011","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Doe et al 2023 show that","venue":null,"work_id":"3a54b226-63dc-4c8c-a33f-5d3253cc08f4","year":2018},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:cd160f0b0c62ad1285ac609f4249f79c8ed56b677a57ff15823478b5cd66ecc2","observation_id":"73730a28-31c9-4dbf-8e40-2e7747f7dad2","resolution":{"observed_at":"2026-05-18T04:25:51.774704Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2eb3097d-cfec-4aa3-a9d1-397dc2d7dfa4","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:36bd0371ebd1fbabaaf51ac6e6492848b6a4ec9f92135ed8ae7dbe91cc49bcca","observation_id":"8950f273-dbe0-448d-8b25-79e218d51e7f","resolution":{"observed_at":"2026-05-18T04:25:52.925349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"For example, it would include specific names with some details of well-known medical datasets for ML like those mentioned in the examples","venue":null,"work_id":"54cb3ba5-8724-4238-89ea-6731a4dbede5","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:f709ff5cab44c168199f8d4b1978006285ac97e75e93de923602d9a75164dc5f","observation_id":"cef41210-ca65-4b5d-8083-3fc9c99b0097","resolution":{"observed_at":"2026-05-18T04:25:52.844912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b77371b8-cc20-4c11-bbfe-f77787448d1c","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:5dfcc2a9df2a09ae5c59598e978e5c4a8c7cc768dbf8c4cb8d70621b5fa76181","observation_id":"d47468c3-a7a0-4c99-a2c2-c2c0ad48cbc4","resolution":{"observed_at":"2026-05-18T04:25:53.019979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"elicitation sessions\\","venue":null,"work_id":"11ee6e47-5484-4ce6-b792-f01c17ab8b62","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:78d91979fb05c64ce932886e02992f8d24d540790884e184957826c3252b96e9","observation_id":"0616e486-5870-4cba-8ac0-e866d7ccac0f","resolution":{"observed_at":"2026-05-18T04:25:52.937341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":"1706.03762","doi":"10.1186/s13550-021-00830-6","metadata_source":"pith","pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention Is All You Need","venue":"cs.CL","work_id":"baafb5a2-5272-43bc-932f-09fa9ffe5316","year":2017},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:62ff0ae74f1ccd2f3944474b59bf829593d6ce57df7388c4a2c68696f1df4286","observation_id":"89fb1ca0-ab0d-4e65-a3d8-470950b642e7","resolution":{"observed_at":"2026-05-18T04:25:52.282771Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c6bcb1a4-6cfd-4779-a401-91a56343317b","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:60f08e9f2f97e061d551b795e857a0d8166ec526513ac60006c063133afea031","observation_id":"90bbd1e2-3637-4638-b295-c0bffacafbcc","resolution":{"observed_at":"2026-05-18T04:25:52.933207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SHOULD” or “MIGHT","venue":null,"work_id":"140d66a2-7b21-45c9-aa5b-15d2aff672d2","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:a52623cdf45c0044b794e9c5c549e36561b6d6446c454a39cf3177a6e19e73b9","observation_id":"6fc2dade-bd36-4e15-9f0c-f0e240958109","resolution":{"observed_at":"2026-05-18T04:25:53.057685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"53a5f1d1-2da6-4cd3-a067-1fb45b1c669f","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:16b3698df3cc59e97a6f24e0973d84b4cca8f8f23085635aadd60e2c65324a53","observation_id":"2f14de5d-5b76-4f54-ab9e-416549d78f1c","resolution":{"observed_at":"2026-05-18T04:25:52.941175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Remove examples that you judge are not directly relevant to the key requirement.,→","venue":null,"work_id":"b6e6f287-f0f3-4e9b-a3ce-5f55743eb329","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:5b3ad984dc15ad5344e30ed626da7d798f1442d84e1ffe9d6a6d60dc71add30f","observation_id":"8a59026c-8446-4854-8b2f-39e1d1f768c0","resolution":{"observed_at":"2026-05-18T04:25:52.945436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"discuss physical commonsense datasets like PIQA","venue":null,"work_id":"cc41f767-7be0-4ae2-9f11-f8366bc6c49d","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:3e3f5b3ef036e65494d5ec3d2dd1079615e658f8280f7814a1c4428a1360c7d5","observation_id":"292e16fe-9557-4385-95c3-bf591af4340a","resolution":{"observed_at":"2026-05-18T04:25:52.964460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c893d3a2-c04e-4a30-8794-d99f25c2823f","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:e9ea27bdb8cfcf1bdec8131b66a82dcbbbbf9def74de6c5da0b9d2477ae243f8","observation_id":"1d25748d-50a4-48f6-86a2-307aa8c19aeb","resolution":{"observed_at":"2026-05-18T04:25:52.983093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f7564b39-9de0-49c0-a956-006a3c4c0a76","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:60102648562aaf583d0b8e14b95232141a8439e09866d87f812cee4b0f3ac451","observation_id":"cac50712-fdd2-421f-8256-b7c6edc08c82","resolution":{"observed_at":"2026-05-18T04:25:53.010461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f8bc59ab-06b1-4a7f-81ee-aa575c3cab15","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:68785cc28ea7becf18a6ef6a13c8454b44f3b5efd7be59fb6945b2fabb1f8721","observation_id":"f3821c9b-9377-458c-8ba3-0d882719a413","resolution":{"observed_at":"2026-05-18T04:25:52.979691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"480ad49f-8c5b-4ea7-beec-f37e04532ca0","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:8510a68c8926ded734fd304f143e6e2a49ac9dd7b6df0868d09ab7a779db2894","observation_id":"3062b5ea-ad34-4d52-84aa-360249cd5df8","resolution":{"observed_at":"2026-05-18T04:25:53.000951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4fb90dcc-7f6f-4cc0-a69f-e83511d8e557","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:edc5d9e756e659a40ec1363a1f911bbecaef5f64ad27990db207c48491a96367","observation_id":"d45f9991-5359-4f41-81fd-3cfd383df0fd","resolution":{"observed_at":"2026-05-18T04:25:52.986627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"17b5d3eb-fa78-4e57-9027-2cf4aca0c0b3","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:23009e8a7dbb3c6cd3e276af768d814bcc48ed3529e7b07f343853d7483cdeeb","observation_id":"cd78edcd-4d87-405f-8803-d7a7bd262ec9","resolution":{"observed_at":"2026-05-18T04:25:52.852787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cc987484-9476-4c5c-be3a-666e0862c122","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:c82794589bcd212d3025a08f1e56240a564f550857446778b1574ed7efab7063","observation_id":"a9966635-e7d6-4c5e-8bb0-cf829af90f6a","resolution":{"observed_at":"2026-05-18T04:25:52.848619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"/results","venue":null,"work_id":"329ba2f5-9110-434e-b622-f9e97702fd37","year":1979},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:62d0eb8383dbf51122607b46d16e0d7f5924468fd015103c1617983f415d1e44","observation_id":"b1e808b8-d552-4451-8602-34017c8aa181","resolution":{"observed_at":"2026-05-18T04:25:52.859867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2f3ba8a2-78f7-48de-86f9-fc79bf06b26f","year":1979},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:320d321dcd7a29d992b5c6d153ac41e9d469c4f82b3df49079f856774e2e149c","observation_id":"d39627ae-9d31-4a3d-a165-a71cf8c021c2","resolution":{"observed_at":"2026-05-18T04:25:52.877960Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"results\": {","venue":null,"work_id":"9873fefe-a65a-4b5a-9ddb-5eb1522a7841","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:a77b5aac7bfd5c9af4847d734875161ac47d61d49fcb0bcccfe56ea694b5c5ab","observation_id":"31d807f0-1310-404c-9f63-1ef38865c822","resolution":{"observed_at":"2026-05-18T04:25:52.997862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c95e7e61-1be9-4ecd-89a8-d4d9b91397be","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:a456b0803ee2619194ea063f0011a716f7ed289e6ac8c5c324f83f7dcf870fed","observation_id":"03f6763f-d4c9-4c23-8179-0007b022d5f0","resolution":{"observed_at":"2026-05-18T04:25:53.007139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d2ce39a5-bc79-4979-b5ae-2417d709a39c","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:5119e4f751c24cc3c20ba4c81330466e2b92efa983c396eede758a6dc70565a0","observation_id":"0c1202ef-f219-4442-a621-437e7122f12a","resolution":{"observed_at":"2026-05-18T04:25:53.013570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"47f639f9-1b4a-4ffe-8488-122cece866cc","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:a86f5b62014dfd1608e9e36273cab46512fa6f70a3d717296b96ee2bfd27b927","observation_id":"b6325434-ca77-4ff5-b555-4db9a8633b9c","resolution":{"observed_at":"2026-05-18T04:25:52.863762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The dataset should be split into training (60%), validation (20%), and test (20%) sets","venue":null,"work_id":"e69a7ec1-bf82-4233-8df3-13686dbf6531","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:45cb49ea8b815ea6cbbc6dfe7e2905880c99f8c510ccc78458239e1d68189965","observation_id":"102bbc09-3eb6-4563-861f-30d75da67ade","resolution":{"observed_at":"2026-05-18T04:25:52.888510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e887f49b-d1b3-4e02-be75-1cae48cffb66","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:0e820b2106e3dcf01c781b5942d2bab828ea57275f568ead4d696024a6288b45","observation_id":"719082b0-faf3-4b74-bb1c-d731c5de47d5","resolution":{"observed_at":"2026-05-18T04:25:52.960611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a972e251-a18c-47ed-b91e-6e9fe29908a8","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:05492da92fc38a3db0508bbc57c14b9d57b585a33ad0079c09333303ec49bd94","observation_id":"e0e317da-9178-4e2f-88b4-7c339f6cc23b","resolution":{"observed_at":"2026-05-18T04:25:52.884763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fd38a6a0-ef06-4494-b9f7-fdbf43ed781c","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:9a1b7eb2f5e8fd4aab16148c3d7f6822c3ce5537fca984c5c5d3f6c2fb236c32","observation_id":"f8ae97cd-1d9d-427b-b87b-8b3248ffc95a","resolution":{"observed_at":"2026-05-18T04:25:52.956603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2bf8d4ee-e23c-42f3-b7f9-1574de94d491","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:c745f327d0bc41bce4088727f098daaa25756adfaf61e6cdcf2979480e92a5f2","observation_id":"a065d818-4be4-4014-934b-f8e724fa52a5","resolution":{"observed_at":"2026-05-18T04:25:53.016873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f6333381-f36a-4091-b268-0cc459034f10","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:6f0bfd0fd01a2a6a44bbe92f06c37948c0b9b26b59e015707dc16eb3e9dd8816","observation_id":"3b8bc357-6ed6-43c1-b7c9-851c0cde7ec2","resolution":{"observed_at":"2026-05-18T04:25:53.048143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bdf6e425-d3d3-459e-a6fc-76bb38c1de06","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:29193071fc803ec1912089bc7d0e99cef59d04cc57dea9c773680d8464680de3","observation_id":"37800129-2b71-46b0-a928-210e337b821b","resolution":{"observed_at":"2026-05-18T04:25:52.910450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"12cea029-80f7-49e4-8cea-217546cadf18","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:5a3b7d64e6f16b93365d2a3df2f968a877decc14018ea7d29e9d2466bcfec2ad","observation_id":"888537b6-8389-423c-a390-c3ac3f9b5138","resolution":{"observed_at":"2026-05-18T04:25:53.051402Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2d1dd9f2-7401-42c8-a658-029fe500e85e","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:18e85796176f483f2a883ca21967d8e695e64f9afd5488aca967aea94751e1a0","observation_id":"15b37d5c-c820-4d48-b057-219fab5e5ba9","resolution":{"observed_at":"2026-05-18T04:25:52.896490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"24f8724a-a549-4a5c-b56a-1b794ff9a246","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:a706041e64eb066e3eb4615a4e0b58d15696cb4095ac48427bed3e689624e3dc","observation_id":"3c0f41c1-5ab8-441a-b12e-9f63710ed361","resolution":{"observed_at":"2026-05-18T04:25:52.899752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"914221ae-3cfa-4f49-9a46-665cb3ae27c5","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:ab75445863d77747c659323de81ea7ced08e08a4d6de9d258bf2083a47b5c437","observation_id":"18515d15-e7db-43d9-907a-8c2c1bb3d7c4","resolution":{"observed_at":"2026-05-18T04:25:52.903115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b085c073-f438-434c-aef8-64a3b317243f","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:946f3cb1d370ed059fc6653b5320f6b1e1cb46187136456a370702fedf2d54a2","observation_id":"627fd735-dd0b-421d-8f99-b7829a479f2b","resolution":{"observed_at":"2026-05-18T04:25:52.968076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IDL based on question characteristics,→ ## Evaluation Evaluate all four conditions using","venue":null,"work_id":"e032ff4a-75cf-443c-8092-90a1746ee9f3","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:ca59083ceb893f0deb052d8faa4062d68e071b8e7abcf2fb0eacbc228e26d24b","observation_id":"2ba934ee-cb32-44a8-ae63-636a466ef2b0","resolution":{"observed_at":"2026-05-18T04:25:52.976505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dd2ef70c-72b1-4409-9513-9873469bfd9a","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:1fbfca1f1bfd7f5fa1016f365edfff07edd283cc62256335a0981eb31c041a60","observation_id":"ccd3ee47-77b0-4740-ad45-943b17b78304","resolution":{"observed_at":"2026-05-18T04:25:52.917744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"00fba0dd-1dae-4733-8546-1591bb25bf96","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:0aa24d1125e3d3a47bcd7ef7cf1e83490d364ae1b96c6d7513be4ae4e12efac1","observation_id":"bd171c5d-eb89-4ab8-b674-5d4b3ae1bf84","resolution":{"observed_at":"2026-05-18T04:25:52.949011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"26660dd0-ce86-4955-860b-83b42c714124","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:fedb78cb8c9612db7a48861ac5d2c4991d5a1e6115431b03431428508fb88e20","observation_id":"7e7bdd98-4961-4e61-a6f8-706bfc61afd8","resolution":{"observed_at":"2026-05-18T04:25:52.952703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0812c45d-f255-4fe6-a083-0ffa01c2a4b5","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:fd1f63dca49f481708756854c7fe5cf60863d12ed8bdd7d1a6fe5a1cd9f6697f","observation_id":"dc10d6de-f328-4ce9-a521-07ec8426ce9f","resolution":{"observed_at":"2026-05-18T04:25:52.972410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4a044fc1-52f5-4c81-97cc-ee7a98a63b42","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:24d9b11d256f0d446cfa6158354e546565cf4b09fabf305435815a61768c811a","observation_id":"3b41e136-3992-4036-9354-5fdff2a52954","resolution":{"observed_at":"2026-05-18T04:25:52.990156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"91f5ff50-4914-410a-a974-494519f006b7","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:93652a584ee48bb76eabc3b6e711cd9e79bedbdcdbaaa974cc3488dab746f79b","observation_id":"523192df-1f7a-465e-89f5-fe3eeb28fe36","resolution":{"observed_at":"2026-05-18T04:25:53.044769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"21a94ae9-2a2d-43a8-bb5c-9af055a15d59","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:3d21ad89de407515ab56ca7f2a6fff1ec500fae64b05a67651bf3d603d5756e0","observation_id":"793bd401-28ef-4b13-9197-fec72843d2b1","resolution":{"observed_at":"2026-05-18T04:25:52.906694Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2b5454b0-2789-4272-ae45-56dcda117d00","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:dfa650f5830d6f48f4da2e8f0cbeb482fadcf0f491181bccf132ab9e46717cba","observation_id":"5f15ad0c-70b9-49b1-a2e3-6038a0b62cec","resolution":{"observed_at":"2026-05-18T04:25:52.867167Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"19ed9f86-d688-4b89-93da-fc3619146904","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:de6404dcb32f6154b54dbb8ae529d2f96b6e88d8b4d7f7e87b5df31d6344eacc","observation_id":"f247f382-d259-4c65-a86a-f67910ccc388","resolution":{"observed_at":"2026-05-18T04:25:52.874552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"63d99c73-bfa9-4c82-b0df-5de2cb495654","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:8eeea4bf266235cbf56a970d381c90b276f32f75f600e6b0003bb1fc119f02fa","observation_id":"64afc6d2-9934-4625-90f0-f3a057762d67","resolution":{"observed_at":"2026-05-18T04:25:52.871166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0b8299b2-7c5c-45d5-98b8-d4db628f5b48","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:a04389172be9238a19ef7d48cf8ea48f85b2c884c5b343d9dcc84fb74a83836c","observation_id":"5e4f7579-47ab-47a8-9302-1422ceca40e8","resolution":{"observed_at":"2026-05-18T04:25:52.929449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4184ea81-6ca4-46c0-8945-e7d3a7780450","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:a16bdba3d91e86788fd2300187d85fbb23bf130df90493e4cbf6c46d58d47116","observation_id":"49c69f8d-abd0-47dc-8087-bdaeebc19e76","resolution":{"observed_at":"2026-05-18T04:25:52.881470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"77af70e2-36b7-4540-a759-631442c857e6","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:2bc75375afbc3723444f49b2c4422fdf5bfec0ef27463128f60bd2c02f1fc154","observation_id":"3d96c2ef-48ba-4447-bd4a-e869189fb67c","resolution":{"observed_at":"2026-05-18T04:25:53.003807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do not proceed to FULL_EXPERIMENT without human verification","venue":null,"work_id":"dcbec4a1-bd6b-48c2-aa07-99038b55764c","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:f7f95318b9c3f3170d1c27381dc2e10076368d360e4e23e86b7655edfc395cb5","observation_id":"7a153785-6ff3-4047-b1bd-c5882dd75e2e","resolution":{"observed_at":"2026-05-18T04:25:53.024028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The report should include, among other things, the following parts: Title, Abstract, Introduction, Approach, Experiments, Results, Conclusion, References","venue":null,"work_id":"16c4dfae-e105-4a3a-ab75-18519eaf7be8","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:f1c127f035fb62e0e93a0f99562e61ac77650d2f5d097d62f3f6f42e77ce05d5","observation_id":"91fa1583-870d-4af0-a1de-ceb570a21ac9","resolution":{"observed_at":"2026-05-18T04:25:52.914433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b966b26e-28a2-4f65-9399-7b3aafa36aea","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:9bc86eb8a8e94a53300cf99fc80cdb404325f57cb5c576ba8e6fc772d9178321","observation_id":"e87c8aec-fa65-4fae-95aa-716ee3ba92fb","resolution":{"observed_at":"2026-05-18T04:25:52.921417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The trace should give a step-by-step description of the actions the agent (you) took, e.g., searching the literature, writing and executing code, analyzing results","venue":null,"work_id":"86a8539f-66e4-4cab-ab66-de8ebd371654","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:196583bdf3c11c7846ac823b3261877552556038a7a0b9304637ab297593d0e2","observation_id":"4b1b54d7-9e18-441b-b82f-d35c5f48d6e6","resolution":{"observed_at":"2026-05-18T04:25:53.035040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"results\": {","venue":null,"work_id":"c0fb02f9-ca77-46ed-b525-b6ed96aba0ca","year":null},"citing_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:42.678252Z"},"links":{"citing_paper":"/paper/2510.21652"},"observation_digest":"sha256:f77d66be4ce44e3ddf0f38ff2e00eab6fc0b1178e3180291112ca4580ba1fdf5","observation_id":"437f2c71-6e46-465f-b670-fc13779c8001","resolution":{"observed_at":"2026-05-18T04:25:53.038488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":2,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":43,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 15 inbound Pith citation observations for arXiv:2510.21652."}