{"as_of":"2026-08-05T06:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c25690483df8b0bfb6ec6cabb863dd5ec1c8eec6ed8f9029b02bf501cfd4140d","coverage":[{"denominator":148,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T09:34:09.347912Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T09:13:18.849983Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T09:59:45.800370Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"cited_work":{"arxiv_id":"2606.12736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.12736","snapshot_observed_at":"2026-07-04T09:59:45.800370Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","venue":"cs.AI","work_id":"5bba569f-1baf-4825-a03c-c65a627b507c","year":2026},"citing_paper":{"arxiv_id":"2606.22731","last_updated":"2026-06-22T00:18:27Z","snapshot_observed_at":"2026-07-06T23:57:32.788548Z","submitted_at":"2026-06-22T00:18:27Z","title":"Closed-loop Auto Research for Molecular Property Prediction: Discovering and Certifying Generalizable Improvements","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T09:13:18.849983Z"},"links":{"cited_paper":"/paper/2606.12736","citing_paper":"/paper/2606.22731"},"observation_digest":"sha256:a53c60f821a485524ab269989806f640e4ba8717dfd7e0cc8608de18cd4bfaa6","observation_id":"f6e5c930-6965-43e6-a2da-62e60bc558b8","resolution":{"observed_at":"2026-07-04T09:59:45.801800Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.12736/citation-record","integrity":"/paper/2606.12736/integrity","json":"/paper/2606.12736/citation-record.json","paper":"/paper/2606.12736"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-05T05:17:56.777576Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":"2303.18223","doi":"10.18653/v1/d16-1080","metadata_source":"pith","pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Large Language Models","venue":"cs.CL","work_id":"de1b42b5-4a0a-4b1f-8c78-1f7fe21be6c9","year":2023},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:7794b39d6d057373391f983cbf672be39074983e4ac8c0fa26d05e93fab8efe1","observation_id":"b8259101-55f5-4db5-a8dd-d1f7ba06358e","resolution":{"observed_at":"2026-07-03T11:28:04.338527Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08979","last_updated":"2025-03-12T01:00:05Z","snapshot_observed_at":"2026-07-06T20:51:04.900724Z","submitted_at":"2025-03-12T01:00:05Z","title":"Agentic AI for Scientific Discovery: A Survey of Progress, Challenges, and Future Directions","version":1},"cited_work":{"arxiv_id":"2503.08979","doi":"10.48550/arxiv.2503.08979","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08979","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentic ai for scientific discovery: A survey of progress, challenges, and future directions","venue":"ArXiv.org","work_id":"972dac2c-8eda-4685-ab16-906c8d7431a3","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2503.08979","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:b5a44d818785285e5a6bb089464184af7860a95ac8f5414cbdd1c536df2e3c92","observation_id":"1a195998-a7d6-4128-9d46-013431692892","resolution":{"observed_at":"2026-07-03T11:28:04.348973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15249","last_updated":"2025-03-21T14:56:58Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-15T01:12:26Z","title":"LitLLMs, LLMs for Literature Review: Are we there yet?","version":2},"cited_work":{"arxiv_id":"2412.15249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.15249","snapshot_observed_at":"2026-07-03T11:28:04.342087Z","title":"Litllms, llms for literature re- view: Are we there yet?arXiv preprint arXiv:2412.15249, 2024","venue":null,"work_id":"4deecbce-8824-4049-b2b0-ad37061f5700","year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2412.15249","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:82bc14bb12b94bed744fb2f34edb20700018aee85bc6b4021147b1eebece9c6b","observation_id":"088a97c0-14d2-497f-9984-1e607d3e5aa6","resolution":{"observed_at":"2026-07-03T11:28:04.343776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Biomni: A general-purpose biomedical ai agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0af0613e14a160b1a71946c16f9cecb8dcf81752c26fde809e802256c6ffe3cd","observation_id":"dd5bc914-07b7-4c27-a089-0ce97549ab87","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.21782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:29:51.443202Z","title":"Accelerating scientific discovery with autonomous goal-evolving agents","venue":null,"work_id":"dbd2fa6e-85fe-4307-8f17-7460ecb1764a","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:d4e5ed01e4a792eff6bb44a45c21e4addc492aa2a92c6a797d134961ddade4b5","observation_id":"600917a4-13a8-4f83-ab31-bb6312461346","resolution":{"observed_at":"2026-07-03T11:28:04.346399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12752","last_updated":"2025-08-18T09:26:14Z","snapshot_observed_at":"2026-07-06T22:14:21.107961Z","submitted_at":"2025-08-18T09:26:14Z","title":"Deep Research: A Survey of Autonomous Research Agents","version":1},"cited_work":{"arxiv_id":"2508.12752","doi":"10.48550/arxiv.2508.12752","metadata_source":"pith","pith_arxiv_id":"2508.12752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deep research: A survey of autonomous research agents.arXiv preprint arXiv:2508.12752, 2025a","venue":"cs.IR","work_id":"94fabb43-10d5-4689-a4ff-8b7caab0406c","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2508.12752","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:9e84496fa1e7bb28b273bdcfafa2ac3fd3800d13e1d5cc848680ad10c4a865d4","observation_id":"ba1a6bda-91d8-410c-b1ae-48d5ac888d87","resolution":{"observed_at":"2026-07-03T11:28:04.336232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Deep research, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:c7035b6926e58f83d5791fad9ea9d33d4411eb15a334c60247bfb112c1399428","observation_id":"8e008be9-ea43-4540-b451-d912f36af72a","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":"2502.18864","doi":"10.3917/res.232.0099","metadata_source":"pith","pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards an AI co-scientist","venue":"cs.AI","work_id":"485486b1-a1a2-4cde-bdda-768930c403e6","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:c746bf02d85d7ce98a51381f3683b7771af4d051f5de0628970ad969f46c3695","observation_id":"b701393d-a93c-4efa-baa8-94a26fd38252","resolution":{"observed_at":"2026-07-03T11:28:04.341255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Towards end-to-end automation of ai research.Nature, 651(8107):914– 919, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:b2549ad45635077465a698ca5ca6457c2dda150309b2fe6644f0aa534638e82c","observation_id":"0f5d57e1-289b-4fba-acb2-687d1f7d06fe","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.01001","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T11:28:04.337041Z","title":"Sciarena: An open evaluation platform for foundation models in scientific literature tasks","venue":null,"work_id":"94cc85d4-5077-4d5c-af92-f31b08320feb","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:57bcc5a62623c003fd11b3b81dcd2055b3ca4973c249e66b4eb1bc0596dbaba7","observation_id":"f0159f58-24b5-4553-9241-6c3ee423cf9e","resolution":{"observed_at":"2026-07-03T11:28:04.338521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15567","last_updated":"2026-05-08T01:14:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T16:20:03Z","title":"Evaluating Large Language Models in Scientific Discovery","version":2},"cited_work":{"arxiv_id":"2512.15567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.15567","snapshot_observed_at":"2026-07-03T23:49:02.992717Z","title":"Evaluating Large Language Models in Scientific Discovery","venue":"cs.AI","work_id":"78e61008-f642-4d4f-bd41-c09b28875591","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2512.15567","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:4245a19e79c7804619be531971d0ac5fb20a96d43eee5b209a7e9b145cc22fd4","observation_id":"f04ef476-8bc0-4a0f-a835-959f2171633b","resolution":{"observed_at":"2026-07-03T11:28:04.340950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12984","last_updated":"2026-05-30T12:51:16Z","snapshot_observed_at":"2026-08-02T23:41:39.933162Z","submitted_at":"2026-02-13T14:58:18Z","title":"SciAgentGym: Benchmarking Multi-Step Scientific Tool-use in LLM Agents","version":2},"cited_work":{"arxiv_id":"2602.12984","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12984","snapshot_observed_at":"2026-07-03T11:28:04.326064Z","title":"SciAgentGym: Benchmarking Multi-Step Scientific Tool-use in LLM Agents","venue":"cs.CL","work_id":"b00b8c23-7ade-468b-af1f-734876ade236","year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2602.12984","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:03b007b46071e2c7164b87de808f8de4b66aab2092f3290e085cc2e028dd7d08","observation_id":"4a5d332b-b3ee-410f-93d2-9b9884877e8d","resolution":{"observed_at":"2026-07-03T11:28:04.327347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Scienceagentbench: Toward rigorous assessment of lan- guage agents for data-driven scientific discovery","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:ffa9cbae6a2515480d41880999832bcf4e3b867065c52fa29fd2a95434000f99","observation_id":"ff7e7173-a328-489a-ab36-fd765d9adce3","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.13591","last_updated":"2026-06-11T07:16:52Z","snapshot_observed_at":"2026-08-03T09:33:40.408451Z","submitted_at":"2026-01-20T04:44:36Z","title":"DSAEval: Evaluating Data Science Agents on a Wide Range of Real-World Data Science Problems","version":2},"cited_work":{"arxiv_id":"2601.13591","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.13591","snapshot_observed_at":"2026-07-03T11:28:04.290197Z","title":"DSAEval: Evaluating Data Science Agents on a Wide Range of Real-World Data Science Problems","venue":"cs.AI","work_id":"2b26412e-bd8f-442d-ae8f-74ded929436d","year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2601.13591","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0049b0482daa4beab882809dd109875494e3a57a5e0ce7be43cbb9071e469659","observation_id":"553f385b-2b83-4ad6-a73c-6cc75e7d4b7b","resolution":{"observed_at":"2026-07-03T11:28:04.291631Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Towards artificial intelligence research assistant for expert- involved learning.arXiv e-prints, pages arXiv–2505, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:848f23a45f6c3e05af91faebe9886900a48a5819d54f42a993b9f71abf67b738","observation_id":"7e925725-5fc0-46b5-be9b-592b10bde736","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14499","last_updated":"2025-02-20T12:28:23Z","snapshot_observed_at":"2026-07-06T20:39:47.920307Z","submitted_at":"2025-02-20T12:28:23Z","title":"MLGym: A New Framework and Benchmark for Advancing AI Research Agents","version":1},"cited_work":{"arxiv_id":"2502.14499","doi":"10.48550/arxiv.2502.14499","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14499","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mlgym: A new framework and benchmark for advancing ai research agents","venue":"ArXiv.org","work_id":"0b9c0950-4be9-4a42-a77f-55c8e4a80b1e","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2502.14499","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:dd99e062f086d0e486319fcea60b920c0fb8f98056331e6f7e8bb1aeedb1ba55","observation_id":"9362f5de-c93a-4a7d-ae64-b221944a01d1","resolution":{"observed_at":"2026-07-03T11:28:04.333266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21652","last_updated":"2026-04-21T23:10:09Z","snapshot_observed_at":"2026-08-04T11:33:57.955960Z","submitted_at":"2025-10-24T17:10:26Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","version":2},"cited_work":{"arxiv_id":"2510.21652","doi":"10.48550/arxiv.2510.21652","metadata_source":"pith","pith_arxiv_id":"2510.21652","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite","venue":"cs.AI","work_id":"0a2c4e11-ab30-497f-b5bf-9e6f13fd5943","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2510.21652","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:cd9d0dfc9f7df0f3280731b9ab602f2aa009925e492782d5bd67bbfcd19594dd","observation_id":"56092da5-4202-4570-9163-10b947328fdd","resolution":{"observed_at":"2026-07-03T11:28:04.310517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Math- arena: Evaluating llms on uncontaminated math competitions.Proceedings of the Neural In- formation Processing Systems Track on Datasets and Benchmark, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:2893cb339533820dacf55fe83ba28af0b247cdef923862c4c91e1143a53d5c23","observation_id":"a10943d5-5986-47d0-b08f-af1485fff674","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Folio: Natural language reasoning with first-order logic","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:61e5cc9e8a1235e7b7460599f07c10a886be7345da485b438f87f943e613558e","observation_id":"c96cd293-1f29-4ad6-9861-02b6fd469efc","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Scicode: Aresearchcodingbenchmarkcurated by scientists.Advances in Neural Information Processing Systems, 37:30624–30650, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:9b9d7e362a5647876a2b7ba53f4fbef52e4a09839d0af7a7f7305ff217a59d8d","observation_id":"21963a0a-9564-4c7f-aea3-eb4b14b5e50f","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Swe-bench: Can language models resolve real-world github issues? In12th International Conference on Learning Representations, ICLR 2024, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:f1ac4eb272e52571e3df54d186c8d13b461e19c6185ad9843f350f6c849d788b","observation_id":"99da8693-c011-4921-b465-a555ee035378","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:ea3730e6168cf51f75493dd35aa3bb5af5e067a684dc22dd7e8b30a8876d2d72","observation_id":"529876cb-7e68-4b3b-829f-3462d464144a","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Sci- enceqa: A novel resource for question answering on scholarly articles.International Journal on Digital Libraries, 23(3):289–301, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:ca65bff0f71108e0d3fc6e63a83215ff5b6054ed62c085457e56afa4feca0c4c","observation_id":"9a08d040-a7a7-4200-91ae-a4f4aa5a038c","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Bioml-bench: Evaluation of ai agents for end-to-end biomedical ml.bioRxiv, pages 2025–09, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:98184b724f44a9f48c2e7d8a4d92aa9233099151921c6225fce9d0159dfc904d","observation_id":"50afc11a-25bb-4b6b-8cb1-10787b21df8c","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.00096","doi":"10.48550/arxiv.2503.00096","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laurent, Alex Andonian, Benjamin Tenmann, Siddharth Narayanan, Geemi P","venue":"arXiv (Cornell University)","work_id":"2087a6ab-f9bd-47ad-a369-36820e1a8a5e","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:bd16f639790c70f660a82aa7170da42515f9039dfb68824088600f5444739cb7","observation_id":"315a4652-06d2-4831-b664-e6e93b8a9085","resolution":{"observed_at":"2026-07-03T11:28:04.330097Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.08341","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T11:28:04.323179Z","title":"Benchmarking AI scientists for omics data driven biological discovery, January 2026","venue":null,"work_id":"9228fd25-ea15-40a4-b398-0626946e187a","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:7da5929d8e7c6ffb88bc18ccb5fc6afb678e33a35a4869a0ea6148c8e55ab4a5","observation_id":"0748f54e-9bd7-4dd7-b87e-6396f5f72a73","resolution":{"observed_at":"2026-07-03T11:28:04.324765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Agentic systems are adept at solving well-scoped, verifiable problems in computational biol- ogy.bioRxiv, pages 2026–04, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:2b64b836a657175315672aa762edb4658544ef794b42309e15bdb54fe50e21e3","observation_id":"8b664837-551b-459e-81df-26f25a486e02","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11868","last_updated":"2026-01-17T01:29:30Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T01:29:30Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","version":1},"cited_work":{"arxiv_id":"2601.11868","doi":"10.48550/arxiv.2302.01973","metadata_source":"pith","pith_arxiv_id":"2601.11868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","venue":"cs.SE","work_id":"0624be05-1d97-4fd6-8300-b04b8a3ab04b","year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2601.11868","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:31907256ba235e4f00d06b9b8bbbed8c49a246b4838f6bc2874251ce310cbc9a","observation_id":"3de0e178-5756-4c2a-a079-63bde3a98fdd","resolution":{"observed_at":"2026-07-03T11:28:04.318430Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Gpt-5.2 system card.https://openai.com/index/ gpt-5-system-card-update-gpt-5-2/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:c17a123485a2f8b7a05148c6e2b093fed10eb4ebd1c9bb99756b79241b8bcc89","observation_id":"c8948f2d-7d86-43eb-a377-4739ecd912f1","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Single cell analysis: the new frontier in ‘omics’.Trends in biotechnology, 28(6):281–290, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:1ea1079d3f1e4de7deaa13cc467935bb7011b26a1890c33c84a4a2e113268b18","observation_id":"6da83e22-cd74-44ba-bf2d-78effa85f7c6","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"The dawn of spatial omics.Science, 381(6657):eabq4964, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:2382a4206db2295c1802c695ecbd8215f8c2b7ba13ff2938fb46486fcd83142a","observation_id":"dfdd5bf7-a383-4c5e-9008-8f26cf163182","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"The role of ai in drug discovery: challenges, opportunities, and strategies.Pharmaceuticals, 16(6):891, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:cc6ebc90e32704fc0115c9e48b773a918fd10cf6a0b248a587630834d07f34f0","observation_id":"b1058408-fd27-4ac1-99cc-ead4eb2a48cb","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"From real-world electronic health record data to real- world results using artificial intelligence.Annals of the Rheumatic Diseases, 82(3):306–311, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:6059dd3e80413e3dc236790d162959367f6fc295e6dee641c5ebcd4fcf490a26","observation_id":"330a8842-b1d8-4b29-8527-79d866c88594","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Engineeringaico-scientistsforstatisticalgeneticsapplications.NatureGenetics, pages 1–4, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:f3d1644c18b3c70bf7107f9d022be343cdbbdd5a5f58ee20b2611eef9f46ad08","observation_id":"23434c61-7c97-42f9-a30c-39ee65ad8222","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Gemini 3 pro.https://storage.googleapis.com/deepmind-media/ Model-Cards/Gemini-3-Pro-Model-Card.pdf, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:e501cd5bebc33f93773a4d93e59fafe03a2873d2847bf383ad3b0b0969ad1ddf","observation_id":"668bcba0-af3f-40f2-9183-a4f14f561020","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Claude sonnet 4.6.https://docs.anthropic.com/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0fb0c0dad5e4510676426608b5368e0040f1dc8abc0aa7fc34358cad83fc0348","observation_id":"77dfcb97-c447-4315-9375-1ee781235bef","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23426","doi":"10.48550/arxiv.2509.23426","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Democratizing ai scientists using tooluniverse","venue":"ArXiv.org","work_id":"e515adbd-38fb-496f-ba70-997fe71e0366","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:787cffbd939e5e1f8c0d219153abef90ac971e76e4497b722417d193a2af048f","observation_id":"b1a5af43-ed15-4cd5-8cd4-84db79b8e9a7","resolution":{"observed_at":"2026-07-03T11:28:04.321535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"ChatGPT Codex.https://chatgpt.com/codex/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:157e8f48631fe543899f4f31583090757ec85e1ec4d55154344c3f1627b72f0c","observation_id":"4be6a72b-6657-4761-88c1-432abf119860","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Claude Code Overview.https://code.claude.com/docs/en/overview,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:2f61e5623c879d31bb819c02f5d1d0860061e66fa775803cd867f56646d145d8","observation_id":"d0db7148-67a6-49b9-8983-f7a067bc59aa","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:cef45c7924835924f7174f9b9765f349b195afd3c8438ae1aaa78c80025c5a08","observation_id":"617f3523-3977-4070-89c5-ce9014c1d5c3","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.02276","doi":"10.48550/arxiv.2508.02276","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cellforge: Agentic design of virtual cell models","venue":"ArXiv.org","work_id":"cb9ecdad-2855-4b87-92c1-a9d3dcc9a20c","year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:e8e44bfb4238228dff74f2f40862fa1bdda1a4d2f14c8e898a25665dd82d98d4","observation_id":"adee86f9-1ec0-4355-9f90-69ac4221b11e","resolution":{"observed_at":"2026-07-03T11:28:04.303818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Stella: Towards a biomedical world model with self-evolving multimodal agents.bioRxiv, pages 2025–07, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:c7f91cdcb153e3c9aa415cceda596139ca0c6be7563d9b9c53f417c67aea5e51","observation_id":"9bf35853-3532-4146-ac8b-c6506a539959","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"An aiagentforfullyautomatedmulti-omic analyses.Advanced Science, 11(44):2407094, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:027c029b7d2c0e8b9241dd8e46a37ad4d6eba7bed67967247835678ce6476f04","observation_id":"e47f8139-7e4d-46a9-b4ee-6331d5daabe7","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Txagent: An ai agent for therapeutic reason- ing across a universe of tools, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0b9162aeb1cf26fd45581c0354fc6a9388dc24ca2aac9a9f5a56ba1c55ac26ff","observation_id":"d783677c-0ca6-4653-a4dd-e3df20cff5d4","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Medea: An omics ai agent for therapeutic discovery.bioRxiv, pages 2026–01, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:41bbdfd007f1f6413f6314ed562c35fa3fea26dba860ebdbe7bafa1df5c58b87","observation_id":"7e12e0c1-88ca-48a9-a472-822d645d7391","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"McNaughton, Gautham Ramalaxmi, Agustin Kruel, Carter R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0022519b4d701b7471c95b487f942e13811a8fafbc9da37c94aad78109ef3936","observation_id":"04de898a-1581-4892-86fe-39d3b055811a","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Baker, Ziru Chen, Garrett Herb, Boyu Gou, Daniel Adu-Ampratwum, Xia Ning, and Huan Sun","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:9791f60d36cb2bd9fab6555d6bc020bdef731a0f8c46cba9221a6aa57b989b5e","observation_id":"613b0965-c0f1-4d38-ae0f-f0dc55811996","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Dru- gagent: Automating ai-aided drug discovery programming through llm multi-agent collabo- ration, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:cb6209cdbf2c4ef0295005f8cda4a03ef1a922cbdcea538bed9b4d970cbe9a29","observation_id":"f510318c-5137-47d2-81f3-90951a675d28","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"LIDDIA:Language-basedintelligent drug discovery agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:dd9ab5f0847784137a72768b62ca9502f9d4885b23f17d78b50827b00b43aea5","observation_id":"64d3bb45-553a-4fa9-9a34-07ff4e60dfeb","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"An auditable agent platform for automated molec- ular optimisation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:5b975cfb27561fc824c059f4a2dabd0f8deb0419e17046ab5bab013b49b8d2d0","observation_id":"8641f270-591d-43db-ae5f-ed3ca4757fc6","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Mragent: an llm-based automated agent for causal knowledge discovery in disease via mendelian randomization.Briefings in Bioinformat- ics, 26(2):bbaf140, 03 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:d523b0592f5c093a2b7b73c80c77b5001006277df68dfaead2f9ecfa57513894","observation_id":"4a4d8a91-1211-4b2c-ba66-65be7ec732fa","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:dac14cbe9bb0269bb4bde7a00fff90532bc4fbb12745a8003edf1117883067e6","observation_id":"17343a56-8c74-42e7-ad42-aa166b8dabfa","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09548","last_updated":"2021-08-28T19:59:03Z","snapshot_observed_at":"2026-08-01T15:49:00.774229Z","submitted_at":"2021-02-18T18:50:31Z","title":"Therapeutics Data Commons: Machine Learning Datasets and Tasks for Drug Discovery and Development","version":2},"cited_work":{"arxiv_id":"2102.09548","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.09548","snapshot_observed_at":"2026-07-04T09:49:44.733119Z","title":"Huang, T","venue":null,"work_id":"41bb435a-b447-45e1-afdc-6b08deb86f61","year":2021},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"cited_paper":"/paper/2102.09548","citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0eb1fb9fed7a1873090ba4ecdcd569c3471210f129c5f78c045641ffab72a08f","observation_id":"fab4e75a-be5e-4d9b-85f5-f2fb9b1be29d","resolution":{"observed_at":"2026-07-03T11:28:04.315865Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Patrícia Bento, Jon Chambers, Marleen De Veij, Eloy Félix, María Paula Magariños, Juan F","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:3a0256e503ce112f899b4acc1089e4fbe5aed0e9a0760a5f7573a90d79412559","observation_id":"bfb616ab-e596-4eed-bc2a-6377649a02dd","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Gilson, Tiqing Liu, Michael Baitaluk, George Nicola, Linda Hwang, and Jenny Chong","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:c64a46bdd8896f2a22cdd3a80813b3d879492673b03bbc0169ae165580330b75","observation_id":"102f6667-1697-49a8-9603-1ba3cd6f4499","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Baell and Georgina A","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:84e289da93e5e29160363532650885d556339e72fc6ad28d27f0ca80916607d5","observation_id":"f7db43d9-64de-4c1d-b255-d6d033d859cf","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Guacamol: bench- marking models for de novo molecular design.Journal of chemical information and modeling, 59(3):1096–1108, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0b9509a80163e4453d8c16d9b4d574fde7a5e0edef349b2650cb09e62b40abe6","observation_id":"52544215-78bc-4bff-b560-a82e66694bd4","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Clustering with the average silhouette width.Computa- tional Statistics & Data Analysis, 158:107190, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0cf0ee9b68c785798bcc224a6d872f448adc82130d5a8fc44935d9ade540c658","observation_id":"d25ba20f-586f-49c8-9dd7-e780175ead72","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Fast, sensitive and accu- rate integration of single-cell data with harmony.Nature methods, 16(12):1289–1296, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:587d131916f828e65fa3b5370837e23c3921e945d170f455aa2a25dc174269b4","observation_id":"3731c4e3-fd97-4cb0-9013-4d41747f0551","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Deep genera- tive modeling for single-cell transcriptomics.Nature methods, 15(12):1053–1058, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:222e7e6c86e9799d426ebce0ec8097c7453217b8578538abc41b0ba5a088b935","observation_id":"c0df6c65-78fa-4f84-8671-38fb5698cca2","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Moderated estimation of fold change and dispersion for rna-seq data with deseq2.Genome biology, 15(12):550, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:3154a4ac0189a5605ed539e9cec1f3f5e2989098f526d706ba05c9d866def086","observation_id":"c36c01c4-ee24-4ba4-9b37-e1ac4617c036","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Modelingandpredicting single-cell multi-gene perturbation responses with sclambda.bioRxiv, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:771122ef3cedb5f554cc50c3d5d4bd129f4078a24ddf220914f897c465ebbdc3","observation_id":"c3e2b1d2-05b6-4441-b792-ba9aa3fc270c","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Ibarra, Olle Holmberg, Isaac Virshup, Mohammad Lotfollahi, Sabrina Richter, and Fabian J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:447488b16529e385557ec08d05a45b871419dafecb116d97fa25a9204ee8ab54","observation_id":"4b532c6b-43b2-4a10-850f-d11566b74b98","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Jensen, Lars J","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:57f92e832dc4e7b678c5c781921cdc151115c9d7c3f6ca6e0f485badece343c6","observation_id":"9ec60ada-d6b1-4b21-8988-c3e3c81eb109","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:68e599e64b1b06f83a5d869c1c5825830b70875eb06534cfec434495a3bce5d0","observation_id":"8c40edc0-b1f5-40d2-9369-f91eec6f6acf","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:bef8a83e5a8f7eac330195e32b4c2adb4c04f0f2953c327d46e220f493b04ac4","observation_id":"ee1970ea-252e-4d0c-af3e-f07904250025","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Polygenic prediction via bayesian regression and continuous shrinkage priors.Nature communications, 10(1):1776, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:342f479835c512e3a1faa7f59b258bc9ae4489868e17755e62354590bb666e70","observation_id":"67aecde7-0822-4000-abf6-709abef1fd1e","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Martin, Shengying Qin, Hail- iang Huang, and Tian Ge","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:09c6799a49f10de2b649fcd5426b96c22408cc338a94130b5d2f517bb0129e62","observation_id":"0dcf3c46-6da8-487b-bf77-98479149e3c7","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"The gtex consortium atlas of genetic regulatory effects across human tissues.Science, 369(6509):1318–1330, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0170b609be5ddd83538577ef931f4154b16e812d006c6e93c382e3cb76315f43","observation_id":"0d42cd2d-fd76-4a08-bea6-9b0e22f788d6","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"On the art of compilingandusing’drug-like’chemicalfragmentspaces.ChemMedChem, 3(10):1503–1507, October 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:b929571323a9a3d9eb0f32d8a4e6361fc9bc73c6a0c527ce89e09c96248dc417","observation_id":"e454e79f-712d-402d-b502-46cca5057be1","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"conda: Asystem-level,binarypackageandenvironmentmanagerrunning on all major operating systems and platforms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:484d0f5abb11e23e27450360a28767e5c3bf980607b99736ab46054b9626f8f0","observation_id":"67aabd72-7739-46bb-880c-98eb1c069449","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:0493950947ded08797124959d838ecade10031149baa183a6affc30d0f0e3d5b","observation_id":"41524d9a-e7ef-4319-9bec-7cd0b7606044","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Shoemaker, Paul A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:ddd573cf43e4c4b85c4088403ed98e87d6740db604926cec6cacb239d48207ac","observation_id":"f48e4184-02e9-4d6d-b491-b8f92ab13a3b","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"ChEBI in 2016: Improved services and an expanding collection of metabolites.Nucleic Acids Research, 44(D1):D1214–1219, January 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:55124ba9a15b967224e212bd160a456ad72d65ae04c52906dbd9756319b9834d","observation_id":"04549f40-8815-416c-bd01-356d7725b572","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Irwin and Brian K","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:271d1264d713fd6d317c0ceb73e1fcb80ba5421af861e47a8caa4706ca395313","observation_id":"c1a3a50f-027b-4795-8fe2-e0943d777f6e","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"A clinical road map for single-cell omics.Cell, 188(14):3633–3647, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:6efa20c364d988b93b646a61c2a6283caaf240f2a87a60800b0ac34f07ce733d","observation_id":"6a56dd84-a1af-438f-899f-4633387692a6","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Single- cell rna sequencing technologies and applications: a brief overview.Clinical and translational medicine, 12(3):e694, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:3878e08f2e7ddc7970aab2cf63a6ea6dceb678be65d90d0b5dbd753e5a321d27","observation_id":"c03d2ab1-6a30-4cac-9b0f-5e7ff764a0ae","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Scanpy: large-scale single-cell gene expression data analysis.Genome biology, 19(1):15, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:adab179b33d05b3073dbeea5e8dc6a71ec6586d809fe7ad8bcf948214fa76d22","observation_id":"0c0b2c54-31fd-419f-a2aa-23cc7e028f4c","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Benchmarking atlas-level data integration in single-cell genomics.Nature methods, 19(1):41–50, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:b466743616c0cd808715675e33bb86715b93d255d01163b7f9ad69279ba39145","observation_id":"24bebf7e-9378-4f0d-8e1c-fb4e0df90e6c","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Scikit- learn: Machine learning in python.the Journal of machine Learning research, 12:2825–2830, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:bd2cfef0c3ffc5ef760c9f276cc7645abcc80614c4ea1baf8997a642c8f4bd72","observation_id":"fd99c5b7-4140-4bf9-a806-d7bcc158efb2","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"A single- cell transcriptomic map of the human and mouse pancreas reveals inter-and intra-cell popu- lation structure.Cell systems, 3(4):346–360, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:91a65772453a61e75c550bb7bb8f6e485d7127f4c007d70f0c0c6a2ee507e0f0","observation_id":"980f398e-abf9-449d-b9a5-40608757f5e8","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"A single-cell transcriptome atlas of the human pancreas.Cell systems, 3(4):385–394, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:d6d8db2d7b475260429551e59317d6054fd7dc3ea13ba37d7da40925ab4c5d96","observation_id":"33c79c83-26b0-4989-9f87-864fbc8d9d7a","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Single-celltranscriptomeprofilingofhumanpancreaticisletsinhealthandtype 2 diabetes.Cell metabolism, 24(4):593–607, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:60ebf01f58dcbbfe933b31eb45fcde98e4f605bf94f36db1a4fe254863fefc46","observation_id":"74429ba3-2bbb-49e2-9dac-4eeb073735a4","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Single-cell transcriptomics of the human endocrine pancreas.Diabetes, 65(10):3028–3038, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:a9ccbcd78a3dd02e82c2bbea88f42f0bdf263917da1195b3a9294d0b1b6f5c1e","observation_id":"fb150495-64c9-49db-84ef-0eb28ee74c9a","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Rnasequencingofsinglehumanislet cells reveals type 2 diabetes genes.Cell metabolism, 24(4):608–615, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:6deef287d3d7f65a6189607fa19d224ad6bde9a41ab4d9e59341bb5fb76eecc2","observation_id":"0aa1aec8-36c4-4206-be04-d5c19c51b206","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Massively parallel digital transcriptional profiling of single cells.Nature communications, 8(1):14049, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:eb8d05760107cf1aea06bc269ababed9532adb58179bd2d59316e1b5b82ecf7c","observation_id":"97a6c801-f9f1-4754-8f3b-dd082921c988","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Cells of the adult human heart.Nature, 588(7838):466–472, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:45d94619ba0b32a709525b649848cff7620e0f23b8305b24ee465105ec5b326e","observation_id":"ca31f499-820f-4662-88c0-b79af47e388c","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Cellmarker 2.0: an updated database of manually curated cell markers in human/mouse and web tools based on scrna-seq data.Nucleic acids research, 51(D1):D870–D876, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:5d39b0a712580a8b95ed3c79991fd6f688cdd25267e31f3aad0ba7fa58d80ec4","observation_id":"6feb7bce-06b3-4ccd-9657-065facf245f9","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Beyond visual inspection: Principled benchmarkingofsingle-celltrajectoryrepresentationswithscTRAM","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:5bf59231e124df8c91f62b99a5bc1074af68b672dce85de33197c2c96695d2b7","observation_id":"9cd7ddcd-a1b3-43e0-9363-acea5e4f0ba1","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Mapping the developing human immune system across organs.Science, 376(6597):eabo0510, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:ad16d8f8c2943dd19f1a7621dd7980b304e43e7c4b4d42addbb5125523d7c8c4","observation_id":"3a184e11-0187-461f-bee8-dd8309b3a583","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Evaluating the utilities of foundation models in single-cell data analysis.Advanced Science, page e14490, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:1c7fb1af434bb2e81613847b56fcc0d6da952c54aae443f7846b813068bc1a59","observation_id":"5470faf5-a35f-4c42-8f62-b014f05832eb","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Exploring genetic interaction manifolds con- structed from rich single-cell phenotypes.Science, 365(6455):786–793, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:1306840feb8b3c9017ee743aaf00dc084537689f35a638e465b57b538aa81796","observation_id":"ee1700f3-2b89-4678-8476-97241784c320","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"A multiplexed single-cell crispr screening platform enables systematic dissection of the unfolded protein re- sponse.Cell, 167(7):1867–1882, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:71f4b50d91b42e5764713d7adbde57e737a020e9bf58db8389254921da89ae5d","observation_id":"9eb5fe85-e85e-4307-85ca-90888530569d","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Mapping information-rich genotype-phenotype landscapes with genome-scale perturb- seq.Cell, 185(14):2559–2575, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:88b7e6aa7a8b6536580da9d27b0a4bd81957e08ef50f88bbfccf887748d958aa","observation_id":"5ee31a12-6aca-4df4-a8af-77099e0e51b4","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Fischer, Anna C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:235ba95da04b9f2802a2e3009582c6a9bee0060a2451a146b2304aed5454cb3f","observation_id":"78b84fb2-feb0-4e0f-9907-487fd2120bc9","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Kuemmerle, Malte D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:1f51cfc70db987db0a8dbced072c87e37166ef255ab3536371465d7fdc224027","observation_id":"2883c955-171f-4085-8178-251e4bb7c028","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Spotiphy enables single-cell spatial whole transcriptomics across an entire section.Nature Methods, 22(4):724–736, 4 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:dd8a06599a627bb76d2aa1c7abce2451ea0d6bf064ebcb300ab929c878665ed8","observation_id":"23c9c5c4-cf50-4aa9-8d8d-1710f76f7a06","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Benchmarking algorithms for spatially variable gene identification in spatial transcrip- tomics.Bioinformatics, 41(4):btaf131, 04 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:05db3aceb0369dbf007d768e5743681777215e94c66a511b3e61dba6d442a493","observation_id":"4071ec9f-c393-4b6c-a482-11358f70579a","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Huuki-Myers, Abby Spangler, Nicholas J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:efd332bb24eed98f2486ec438898d6a9dbb94f2c950e7d8d4ea7bd2b9d271863","observation_id":"a8a02bfa-e247-4ec6-98fe-155b871e1631","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:09.347912Z","title":"Weber, Stephanie C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:09.347912Z"},"links":{"citing_paper":"/paper/2606.12736"},"observation_digest":"sha256:7d6b54cddc3a97492526049311b4b0e20bb1977ba90966da4e971a34b33b19db","observation_id":"0b6be691-0a2f-45dd-9e4c-049771da2d1f","resolution":{"observed_at":"2026-06-27T09:34:09.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.12736","last_updated":"2026-06-10T22:55:30Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T11:05:19.132987Z","submitted_at":"2026-06-10T22:55:30Z","title":"Benchmarking AI Agents for Addressing Scientific Challenges Across Scales"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":1,"unresolved":81,"verified_exact":16,"verified_fuzzy":0},"total_outbound_references":148},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 100 of 148 outbound references and 1 inbound Pith citation observation for arXiv:2606.12736."}