{"as_of":"2026-08-13T07:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fcfa0f53ddcfb2ebf4a59303d8609bccaec10beaa58ae9ed80d90abad2c7b45d","coverage":[{"denominator":188,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T03:39:52.204043Z","state":"measured"},{"denominator":115,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":115,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:06:09.456857Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-05T17:51:14.821870Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2604.17406","last_updated":"2026-07-01T09:10:53Z","snapshot_observed_at":"2026-08-13T03:54:32.041821Z","submitted_at":"2026-04-19T12:26:05Z","title":"EvoMaster: A Foundational Evolving Agent Framework for Agentic Science at Scale","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-05T17:45:55.631459Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2604.17406"},"observation_digest":"sha256:177cb6fb280ad4caaf5f4977a50e972db42eaecfbd512e222328c28c3b78ba55","observation_id":"5450e3c9-0cfd-4400-8be5-247bd09370d7","resolution":{"observed_at":"2026-07-05T17:51:14.823388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2605.08678","last_updated":"2026-07-06T13:36:13Z","snapshot_observed_at":"2026-08-12T12:31:22.878512Z","submitted_at":"2026-05-09T04:29:46Z","title":"MLS-Bench: A Holistic and Rigorous Assessment of AI Systems on Building Better AI","version":2},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-06-30T23:12:57.154537Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2605.08678"},"observation_digest":"sha256:09a0f8d51510c399964c1de15cc1ce71b29524a3251b5241bb306e1fbd18e63a","observation_id":"7de77cf5-8e67-4482-8c09-e48ff9b87a92","resolution":{"observed_at":"2026-07-01T13:25:45.962558Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-12T17:14:49.310598Z","title":"Evaluation-driven scaling for scientific discovery.arXiv preprint arXiv:2604.19341, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.08678","last_updated":"2026-07-06T13:36:13Z","snapshot_observed_at":"2026-08-12T12:31:22.878512Z","submitted_at":"2026-05-09T04:29:46Z","title":"MLS-Bench: A Holistic and Rigorous Assessment of AI Systems on Building Better AI","version":3},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-07-12T17:14:49.310598Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2605.08678"},"observation_digest":"sha256:9ab3b63cb1c12e8204b8fd1f6197a5d55a36ad0796f6ae772658d17e29328bbf","observation_id":"68057414-e756-486d-815a-1a3bc8e7418d","resolution":{"observed_at":"2026-07-12T17:14:49.310598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2605.13821","last_updated":"2026-05-13T17:45:16Z","snapshot_observed_at":"2026-08-11T15:08:13.074646Z","submitted_at":"2026-05-13T17:45:16Z","title":"Harnessing Agentic Evolution","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-14T17:56:42.410866Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2605.13821"},"observation_digest":"sha256:b3d53def0199fd9d3b8450bc292534699e3d1a8ac1366ecf97bec460026e7ee6","observation_id":"bc3e5f43-75c7-44d1-852a-d2a13450349c","resolution":{"observed_at":"2026-05-14T17:57:32.829503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2605.20086","last_updated":"2026-05-19T16:41:45Z","snapshot_observed_at":"2026-08-02T02:17:19.395211Z","submitted_at":"2026-05-19T16:41:45Z","title":"What Do Evolutionary Coding Agents Evolve?","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-20T03:44:18.658541Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2605.20086"},"observation_digest":"sha256:a8db39556df9be6668f113812f090ce2a1120033a6d308e38d7177d79f4a1a70","observation_id":"75bdce53-d64e-474f-9467-564b6657a8d9","resolution":{"observed_at":"2026-05-20T03:48:03.250950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2606.06473","last_updated":"2026-06-04T17:55:59Z","snapshot_observed_at":"2026-08-01T19:37:15.448610Z","submitted_at":"2026-06-04T17:55:59Z","title":"MLEvolve: A Self-Evolving Framework for Automated Machine Learning Algorithm Discovery","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T00:57:02.959467Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2606.06473"},"observation_digest":"sha256:466af954559443c340c7d63ca2e14361313635b2c524a5a3c7f219a6d1b59546","observation_id":"d2f981d5-d7df-490a-9c76-9e09eaacdc87","resolution":{"observed_at":"2026-07-02T13:46:59.830613Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2606.09520","last_updated":"2026-06-18T20:24:58Z","snapshot_observed_at":"2026-08-08T20:01:02.316206Z","submitted_at":"2026-06-08T14:09:40Z","title":"Closing the Prior-Posterior Loop: Self-Reflective Molecular Design with Analysis-Driven LLM Iteration","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T14:38:06.900583Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2606.09520"},"observation_digest":"sha256:56021a1be3f896c31a6f6789315f0a6056def5313b3df8bf6fd780ebe5b28986","observation_id":"3062933d-76bf-402f-95a6-e023be0ce038","resolution":{"observed_at":"2026-07-03T03:47:35.813268Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2606.10402","last_updated":"2026-06-09T04:25:28Z","snapshot_observed_at":"2026-08-12T15:37:05.885189Z","submitted_at":"2026-06-09T04:25:28Z","title":"Harnessing the Collective Intelligence of AI Agents in the Wild for New Discoveries","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T13:10:23.450482Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2606.10402"},"observation_digest":"sha256:388b5db06a8538839bb70b627170ac4c5a3688765e6bfc6e6d0edc029d708619","observation_id":"fdec16e3-ec0e-437d-a26c-68470cbd4267","resolution":{"observed_at":"2026-07-03T05:27:40.555174Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2606.24530","last_updated":"2026-07-06T16:56:53Z","snapshot_observed_at":"2026-07-12T12:32:23.590658Z","submitted_at":"2026-06-23T12:58:23Z","title":"NatureBench: Can Coding Agents Match the Published SOTA of Nature-Family Papers?","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-06-26T00:13:14.940915Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2606.24530"},"observation_digest":"sha256:63be0839bd8c59235d3317d74da9ae793bd2f83b9aa2f9338f2b59720e5313cb","observation_id":"0618a0a1-ec99-4a1b-b0a4-c955b9b08796","resolution":{"observed_at":"2026-07-04T16:49:57.829564Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-12T12:32:39.706055Z","title":"Evaluation-driven scaling for scientific discovery, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.24530","last_updated":"2026-07-06T16:56:53Z","snapshot_observed_at":"2026-07-12T12:32:23.590658Z","submitted_at":"2026-06-23T12:58:23Z","title":"NatureBench: Can Coding Agents Match the Published SOTA of Nature-Family Papers?","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-07-12T12:32:39.706055Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2606.24530"},"observation_digest":"sha256:d7ca0e0b1b251a96f0e479f716b3f79858a5ff19a2b8b79adeaa1c79d8152d55","observation_id":"65ec0065-53d7-4689-a671-2c0a7a3d1838","resolution":{"observed_at":"2026-07-12T12:32:39.706055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":"2604.19341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-05T17:51:14.821870Z","title":"Evaluation-driven Scaling for Scientific Discovery","venue":"cs.LG","work_id":"eea45b36-46e2-404d-9800-7fc56ad060b1","year":2026},"citing_paper":{"arxiv_id":"2606.29082","last_updated":"2026-06-27T20:48:18Z","snapshot_observed_at":"2026-08-13T06:44:40.334773Z","submitted_at":"2026-06-27T20:48:18Z","title":"Evolution Fine-Tuning: Learning to Discover Across 371 Optimization Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T09:15:22.900338Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2606.29082"},"observation_digest":"sha256:773bfefbf750dcd8e088c83c1ee9f9c78df17e637f9dbf1eaab7e68cd9ff284f","observation_id":"6d824756-40cc-4d45-bcbc-48a1ba503b80","resolution":{"observed_at":"2026-06-30T09:24:32.773817Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-12T06:56:07.062101Z","title":"Evaluation-driven scaling for scientific discovery","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02807","last_updated":"2026-07-02T22:47:35Z","snapshot_observed_at":"2026-08-13T03:49:38.720490Z","submitted_at":"2026-07-02T22:47:35Z","title":"SwarmResearch: Orchestrating Coding Agents for Open-Ended Discovery","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-12T06:56:07.062101Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2607.02807"},"observation_digest":"sha256:11bdbcd0aed3117cd78ce74b736970d0e9eeb7bb49f3baccb9dab9f5252046d6","observation_id":"8b931106-bc62-4273-9d0f-4fc49a15de8c","resolution":{"observed_at":"2026-07-12T06:56:07.062101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-08-02T07:06:09.456857Z","title":"Evaluation-driven scaling for scientific discovery, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22682","last_updated":"2026-07-13T01:28:57Z","snapshot_observed_at":"2026-08-07T09:12:13.533070Z","submitted_at":"2026-07-13T01:28:57Z","title":"A Vocabulary for Multi-Agent Automated Research Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T07:06:09.456857Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2607.22682"},"observation_digest":"sha256:271647d9c4f0c6332cdd093eadc86f5781ed5c6994f895ef90371885427b56e1","observation_id":"bbf361f1-e582-4205-973a-0c3f180fa2e6","resolution":{"observed_at":"2026-08-02T07:06:09.456857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-07-30T19:53:04.607205Z","title":"Wang, and Yuzhi Xu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26828","last_updated":"2026-07-30T03:06:21Z","snapshot_observed_at":"2026-08-06T22:28:19.418892Z","submitted_at":"2026-07-29T12:21:28Z","title":"Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T19:53:04.607205Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2607.26828"},"observation_digest":"sha256:1045b77b85493b89417ac4418fab577ee319be4fb90b0df607e3808315af2977","observation_id":"32b54f93-7f5d-4d68-8f69-b83e30c42012","resolution":{"observed_at":"2026-07-30T19:53:04.607205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19341","snapshot_observed_at":"2026-08-01T10:47:32.811955Z","title":"Wang, and Yuzhi Xu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26828","last_updated":"2026-07-30T03:06:21Z","snapshot_observed_at":"2026-08-06T22:28:19.418892Z","submitted_at":"2026-07-29T12:21:28Z","title":"Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T10:47:32.811955Z"},"links":{"cited_paper":"/paper/2604.19341","citing_paper":"/paper/2607.26828"},"observation_digest":"sha256:1e6878211fbda2e21fe542059405428d63522656ae7015c70732eec5dbdec177","observation_id":"e0a09e2f-fdc8-4025-b7fc-c821e5b7dda0","resolution":{"observed_at":"2026-08-01T10:47:32.811955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.19341/citation-record","integrity":"/paper/2604.19341/integrity","json":"/paper/2604.19341/citation-record.json","paper":"/paper/2604.19341"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accurate structure predic- tion of biomolecular interactions with alphafold 3","venue":null,"work_id":"777cf475-cd9b-407c-b22f-0268fef29778","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:1687295494195751ae81130b44ec7848e174fa6170946f5e54c149012cf18068","observation_id":"acce27b2-6b21-467c-b8d7-b0037742dd69","resolution":{"observed_at":"2026-05-22T15:16:45.042259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19457","last_updated":"2026-02-14T11:42:30Z","snapshot_observed_at":"2026-08-12T17:38:04.397602Z","submitted_at":"2025-07-25T17:42:32Z","title":"GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2507.19457","doi":"10.48550/arxiv.2507.19457","metadata_source":"pith","pith_arxiv_id":"2507.19457","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning","venue":"cs.CL","work_id":"40b60d06-dc1c-4799-b75d-ff1eca653049","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2507.19457","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:01c6bdbac9fdf72b73039afcaf3e87c639749b3d56d5d8b2723a7f7dfaae1cf5","observation_id":"28b8052a-72ca-47b3-b205-632852f156ba","resolution":{"observed_at":"2026-05-12T07:26:20.435474Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:19.13226+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:19.13226+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Natarajan, and K","venue":null,"work_id":"26c20cb3-432e-46c9-af8f-4cc856021f97","year":1974},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:043cc8ec8495c1ea50813f55a5ff001983d204557d5bd325aeedf6410090aa53","observation_id":"705aae77-88d8-4dc7-8cde-0e3178d25280","resolution":{"observed_at":"2026-05-22T15:16:45.046455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FARS: Fully automated research system","venue":null,"work_id":"c867b86a-a14f-4edd-b9ba-30efbacf991d","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:b369d6d9e2d09517337c1475f7d32568219690cfe95453c2459b3cd216fe6061","observation_id":"028938bf-9f29-448d-a516-1bd8bf82d0f9","resolution":{"observed_at":"2026-05-22T15:16:45.055166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":"1606.06565","doi":"10.48550/arxiv.1606.06565","metadata_source":"pith","pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Concrete Problems in AI Safety","venue":"cs.AI","work_id":"c8d14fbe-6eab-464a-95b3-778aabd82fa3","year":2016},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:9d99abdb4ba5a19abddbf03630d59880cade278508a4ce6b6e3873f8042f6de4","observation_id":"b6427957-8a64-45ce-88c1-26c275cd1dab","resolution":{"observed_at":"2026-05-11T12:26:05.352673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:52.215761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:52.215761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openevolve: an open-source evolutionary coding agent","venue":null,"work_id":"a022b3b7-65f1-45ea-a692-7cddfccf9e38","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:56af3eb48d0524b30e22892be6d4be8a7e12d970caca6f3328f531c339931ced","observation_id":"09680a0c-ce92-4223-b6b1-751e034ef2f4","resolution":{"observed_at":"2026-05-22T15:16:45.063311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14150","last_updated":"2026-05-28T13:36:14Z","snapshot_observed_at":"2026-08-10T14:29:59.159685Z","submitted_at":"2025-10-15T22:58:06Z","title":"CodeEvolve: an open source evolutionary coding agent for algorithmic discovery and optimization","version":5},"cited_work":{"arxiv_id":"2510.14150","doi":"10.48550/arxiv.2510.14150","metadata_source":"pith","pith_arxiv_id":"2510.14150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CodeEvolve: An open source evolutionary coding agent for algorithmic discovery and optimization, March 2026","venue":"cs.AI","work_id":"b31e9fdb-cb9e-45bb-8e54-e6fc74ca613a","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2510.14150","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:a9276ebee8fe5667f79fc7ce684cfbb30e72a1cde630c1c7c43f1da42c981686","observation_id":"51cba49e-ed9b-4974-b4b6-6133946699cb","resolution":{"observed_at":"2026-05-29T03:04:35.386787Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.093376Z","title":"In: Christodoulopoulos, C., Chakraborty, T., Rose, C., Peng, V","venue":null,"work_id":"e6d6ecae-3575-45e2-8c99-76359a926a1a","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:ed0ac6fdc2bfaab2862149901a06f7b480561641f810a237693fa750dcc73dc8","observation_id":"0e0d228b-151e-43a3-8158-6bead22c16b0","resolution":{"observed_at":"2026-05-10T04:40:17.057274Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-03T20:08:10.343755+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T20:08:10.343755+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jnt.2019.07.001","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Barnard and Stefan Steinerberger","venue":"Journal of Number Theory","work_id":"a3510bef-b69a-470c-9755-1baccc0dfb5c","year":2020},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:5ebf72d99763a179a65e5443d3e03de35ef81446bd770714db6d9c435b27ad53","observation_id":"757fb499-2868-4374-bff4-03399c59c12d","resolution":{"observed_at":"2026-05-10T04:40:17.098559Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Molecular cross-validation for single-cell rna-seq","venue":null,"work_id":"6f7188aa-1fd3-4051-9bbe-0fccbc2f75b0","year":2019},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:981235e094306a07d2eb795e2629715064e8d2de603ed2c6ce947484b1772fe9","observation_id":"f599d113-4c0f-49b7-ab75-a1d4feb14955","resolution":{"observed_at":"2026-05-22T15:16:45.070343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph of thoughts: Solving elaborate problems with large language models","venue":null,"work_id":"91fd674e-2af8-4f0c-8f0c-e541c333212d","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:dc847f2eef01ef9fd4dd0340a94abfd6f33846b1ca6276c9547f847f1c94eb3d","observation_id":"e5477e45-9510-42bd-87ff-6465684611fd","resolution":{"observed_at":"2026-05-22T15:16:45.110765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.07040","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:59:52.125007Z","title":"Aster: Autonomous scientific discovery over 20x faster than existing methods","venue":null,"work_id":"420b2eb1-f868-451c-8eb4-61a097b37064","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:182985ac15d3daf4c1aee483c375b1aa1bef2bdf8852c50c39f995b3d69219f2","observation_id":"e9e996ae-9673-4425-b39a-2d64da73b0aa","resolution":{"observed_at":"2026-05-11T12:26:05.905897Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A quantum processor based on coherent transport of entangled atom arrays","venue":null,"work_id":"cde01a9f-3eb8-4704-af85-a19a8e3cef73","year":2022},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:707cd2d68d18f9675cdf26be897a73890343d0b1ca5c71414ba49bb42aabc226","observation_id":"e17f4e5c-ab4b-4cbc-bc5f-b471022fb443","resolution":{"observed_at":"2026-05-22T15:16:45.188132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Logical quantum processor based on reconfigurable atom arrays","venue":null,"work_id":"bca9e51a-14f1-4cf5-abf6-7f8c8d9e88e0","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:e4d5955de45938557f02004991088cfb88e65d5b21f9cb9b7f91ca826b14c44a","observation_id":"581ce452-bd43-471a-8ff8-d36638baae70","resolution":{"observed_at":"2026-05-22T15:16:44.858192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6458.2025","doi":"10.1080/10586458.2025.2481271","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An improved example for an autoconvolution inequality","venue":"Experimental Mathematics","work_id":"fc00c00f-86ff-4a34-9737-9cab36ee40c0","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:e8e6bd0c525514f934a80dc4d7d40a870c287830d3af219eca747fa559bc8bbb","observation_id":"87cc6657-b131-4bec-b4cf-8b28c0f83e2d","resolution":{"observed_at":"2026-05-10T04:40:17.059753Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1112.4160","last_updated":"2011-12-18T14:09:00Z","snapshot_observed_at":"2026-07-06T02:39:36.423649Z","submitted_at":"2011-12-18T14:09:00Z","title":"Maximal determinants and saturated D-optimal designs of orders 19 and 37","version":1},"cited_work":{"arxiv_id":"1112.4160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1112.4160","snapshot_observed_at":"2026-07-04T19:21:58.154856Z","title":"Brent, William Orrick, Judy anne Osborn, and Paul Zimmermann","venue":null,"work_id":"25697e56-a836-47c5-b0ad-74e926515acd","year":2011},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/1112.4160","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:f7d0c762e737da3cd3088e15d57b0d252f4e497ec891fd8fdb2db3326f249bab","observation_id":"fc397eb2-e0f5-4b7b-80e8-41ddd0d65349","resolution":{"observed_at":"2026-07-04T19:21:58.154856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:f5e77e2f451300ab08ac32b19933202161c65c6f9de053cb1eec04989f04baf9","observation_id":"08c59f07-4256-4cff-9239-6b413d11ccf7","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Byrd, Peihuang Lu, Jorge Nocedal, and Ciyou Zhu","venue":null,"work_id":"86cb81c5-66c7-41af-9f55-735eef1d541a","year":1995},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:d57a49216bc4c325916db0436b3cab891f2a7bc383411a31ba8ee1ec1c72d2ec","observation_id":"ba5f1e58-1988-4826-9ee6-9b72823ff328","resolution":{"observed_at":"2026-05-22T15:16:44.862402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.19128","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T22:29:00.449852Z","title":"K-search: Llm kernel generation via co-evolving intrinsic world model.arXiv preprint arXiv:2602.19128","venue":null,"work_id":"6312f515-a452-4853-801a-b99c6219533b","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:c2cb551221dff16e02f6c4439320fb9bc08631c82cbc5ccd4efed832f67a59d3","observation_id":"fc9ebe67-7005-4b3c-8589-7858601a08e5","resolution":{"observed_at":"2026-05-11T12:26:05.606496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cawley and Nicola L","venue":null,"work_id":"56e5ab53-bf87-46db-b081-7fbc3275a31e","year":2079},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:b2e716cd92abc61a95be9bf4f34bd3bf78499597c499ba407ee08cd301eb7858","observation_id":"cf115417-38f9-4d1b-9b6f-ab9d81b46b5a","resolution":{"observed_at":"2026-05-22T15:16:44.850583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20133","doi":"10.48550/arxiv.2602.20133","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AdaEvolve: Adaptive LLM driven zeroth-order optimization","venue":"arXiv (Cornell University)","work_id":"284cc2bd-522c-4674-99da-c07e54d2afff","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:fb9ffdb00d6a81acfca4af192ab878cfda4356fe34fd853d089c87f26b61ccb9","observation_id":"d09a1f93-b5c4-4d10-b5a3-1514c9e7e314","resolution":{"observed_at":"2026-05-11T12:26:08.712845Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01931","last_updated":"2025-07-08T03:19:40Z","snapshot_observed_at":"2026-08-07T16:13:54.542670Z","submitted_at":"2025-04-02T17:40:47Z","title":"On the Role of Feedback in Test-Time Scaling of Agentic AI Workflows","version":4},"cited_work":{"arxiv_id":"2504.01931","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.01931","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the role of feedback in test-time scaling of agentic ai workflows","venue":null,"work_id":"35260f66-7bb2-4699-9ef2-21246bf462c9","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2504.01931","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:a0182f880778319873892543765a427592d51407bcde0fbce24fdcdb938dd61f","observation_id":"a249ab60-1c90-4f2e-94fe-66ab8ebd3aec","resolution":{"observed_at":"2026-05-11T12:26:05.819919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07095","last_updated":"2025-02-26T11:57:30Z","snapshot_observed_at":"2026-08-12T16:49:10.970507Z","submitted_at":"2024-10-09T17:34:27Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","version":6},"cited_work":{"arxiv_id":"2410.07095","doi":"10.48550/arxiv.2410.07095","metadata_source":"pith","pith_arxiv_id":"2410.07095","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","venue":"cs.CL","work_id":"a671e43f-ceab-49e7-adc3-473d802a97ca","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2410.07095","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:40b998f8b531b3333c79bf9e59a06cbc131894d22b44a52d4d060d293ec83c16","observation_id":"e2136a57-a6db-45e2-8324-eec869a62ade","resolution":{"observed_at":"2026-05-11T12:26:07.565713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10475","last_updated":"2025-05-15T16:24:45Z","snapshot_observed_at":"2026-08-11T22:40:53.484752Z","submitted_at":"2025-05-15T16:24:45Z","title":"Parallel Scaling Law for Language Models","version":1},"cited_work":{"arxiv_id":"2505.10475","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.10475","snapshot_observed_at":"2026-06-30T23:35:07.254827Z","title":"Parallel scaling law for language models","venue":null,"work_id":"21e9dd09-a711-47d9-9ce9-3e5cb7213a02","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2505.10475","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:278ab2b33642eede28ecc7d127904ef6ffdb53d525e6e20415766f64e8e02294","observation_id":"85ba890c-f556-41c4-83e5-7bdae37cad36","resolution":{"observed_at":"2026-05-11T12:26:05.369634Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01279","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T01:17:30.684062Z","title":"T umix: Multi-agent test-time scaling with tool-use mixture","venue":null,"work_id":"23fc26b3-af92-4c19-b390-39c0ec96c1eb","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:622f7f779f79910711955bc5796fcf510a41d5a2683107d5daf7bae7ecb66e3a","observation_id":"0629bf03-4c3a-4ba2-b0db-0eeb0d4ee255","resolution":{"observed_at":"2026-05-11T12:26:06.045824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cooley and John W","venue":null,"work_id":"14a2e6f6-8822-4022-bc9c-73290c55e19c","year":1965},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:aa96b73795ff75f2c5a59621a3612ecc190e38c239bb1ad876ecf4f88384186d","observation_id":"b830f27e-c3b4-44a6-af0b-69bdb08c24c9","resolution":{"observed_at":"2026-05-22T15:16:44.843464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.4230/lipics.tqc.2019.5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"On the qubit routing problem","venue":"DROPS (Schloss Dagstuhl – Leibniz Center for Informatics)","work_id":"aedcb938-8947-44fd-b7dd-55f56c29d955","year":2019},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:fe639d53362bc816b4159be4354a3c526fc99f96edfeac349c46fcc207ae9f85","observation_id":"6be4dfb8-4a2a-402d-b3a8-9bc2e8f9bee7","resolution":{"observed_at":"2026-05-10T04:40:17.085467Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.24286","doi":"10.48550/arxiv.2602.24286","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cuda agent: Large-scale agentic rl for high-performance cuda kernel generation","venue":"Open MIND","work_id":"12eb782b-1029-4697-9cf2-d042efa615e6","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:a3072aa1795dce0c81a9b8f493f08ffdf49c2107ae6ddf7607d383618b5bb1b8","observation_id":"d26815d3-1d90-4fbb-a844-27a62702edcb","resolution":{"observed_at":"2026-05-11T12:26:08.724155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sandboxes","venue":null,"work_id":"6515bdf0-6bb4-4c95-a4ca-631a5d518391","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:87260f6f59782abb8db79d3a4faecbaf617967a622cc327a7b62ecf7b7a17fbc","observation_id":"0f493f6d-13e5-4e4b-933b-807d8920b35b","resolution":{"observed_at":"2026-05-22T15:16:44.846941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16975","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swe-dev: Evaluating and training autonomous feature-driven software development","venue":null,"work_id":"3197df70-5de0-4772-aa31-d4c077128c76","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:8910a33e47f3549682c2788bcb97f1873dba92e1ff9b74bc61b4446e6c99abb7","observation_id":"888a6774-1a1f-4811-b950-e7b96e1bd18d","resolution":{"observed_at":"2026-05-11T12:26:07.926760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"E2b documentation","venue":null,"work_id":"1f298bdb-ecdb-49a6-8807-930529b76557","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:d15fbddcd418e80d37d0b0e855ecceac2a8b7642595509504ee410e18266b25a","observation_id":"72ad8daf-a4aa-472e-9e70-a64a5e254cd5","resolution":{"observed_at":"2026-05-22T15:16:45.049697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:51f1e18c2fa9dafefc9e3ed68cb62dcb09d43a7cb87493c888722d5c88bdf41f","observation_id":"66be9b4c-024e-473f-ae01-4a23529ff515","resolution":{"observed_at":"2026-05-11T12:26:05.589442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf02650179","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T15:07:19.323177Z","title":"International Journal of The- oretical Physics 21(6/7), 467–488 (1982) https://doi.org/10.1007/BF02650179","venue":"International Journal of Theoretical Physics","work_id":"47d36bc2-bbec-400d-8725-85c857dc75d7","year":1982},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:97d328c7abe742509e3ec9fb6d320bf5a480868781bd76b0009c5bd28afe855e","observation_id":"9ddef473-caca-4b65-8e04-9a6eda0a159e","resolution":{"observed_at":"2026-05-10T04:40:17.096983Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-08T08:08:14.193019+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T08:08:14.193019+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Regularization paths for generalized linear models via coordinate descent","venue":null,"work_id":"7d11db36-c608-4cbb-9667-ae8b3526a8b7","year":2010},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:afc7684ae6927fc5710010265afbb94d34c7bd268d45513dbb1e12931a1ca40d","observation_id":"f9c49a8d-ea3e-4f22-b105-87dee2dc943f","resolution":{"observed_at":"2026-05-22T15:16:44.865788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"cited_work":{"arxiv_id":"2507.21046","doi":"10.48550/arxiv.2507.21046","metadata_source":"pith","pith_arxiv_id":"2507.21046","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","venue":"cs.AI","work_id":"f5de9511-98bf-411c-9eba-e8b7a914ec18","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2507.21046","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:f509988977d110084b3ceeea07e0784dc997208051c88c6678c613ebbeefe3b4","observation_id":"f0b1ddfb-20ce-4bfd-bc1f-25fa943091ab","resolution":{"observed_at":"2026-05-14T22:23:15.948876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:08:10.122082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:08:10.122082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":"7ff5d65c-4921-4ae7-9a17-754cdad0390c","year":2023},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:d275ad1a874ed378a12c103b565b67832e7ef4450f62bbced1a4e639d2e89035","observation_id":"6d83fd10-21d5-41d1-bce8-3dcefc65acd4","resolution":{"observed_at":"2026-05-22T15:16:44.869188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.02864","last_updated":"2025-12-22T12:49:01Z","snapshot_observed_at":"2026-08-07T08:27:55.662438Z","submitted_at":"2025-11-03T16:04:07Z","title":"Mathematical exploration and discovery at scale","version":3},"cited_work":{"arxiv_id":"2511.02864","doi":"10.48550/arxiv.2511.02864","metadata_source":"pith","pith_arxiv_id":"2511.02864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mathematical exploration and discovery at scale","venue":"cs.NE","work_id":"b3882729-74ba-4d80-9240-bfe03c45c33b","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2511.02864","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:3bfb87bd03da520a5ee8433cb243290c538c6fe151ec32863633ac1b470c323d","observation_id":"155db80f-3cec-4d5f-bab4-931d91c6d8f9","resolution":{"observed_at":"2026-05-11T12:26:05.461093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantum error correction below the surface code threshold","venue":null,"work_id":"c3ad29ad-cd59-4530-9aec-a7cb46da0067","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:6eb5db9657785b196cb3b4bc3a5171dba136848208685961f64d0a631db7110b","observation_id":"565ef521-37f6-4064-8d09-d7eb33720e06","resolution":{"observed_at":"2026-05-22T15:16:44.885188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpu mode reference kernels","venue":null,"work_id":"3558b78e-2532-44cd-97c0-bcc2a9380fe7","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:c60d00ec872824cc8266ca1e72d99092b671433f44fa156e367fcd7a0963191e","observation_id":"b63af8ce-b690-4da1-9ae5-a8b9a1a16360","resolution":{"observed_at":"2026-05-22T15:16:44.882249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trimul competition","venue":null,"work_id":"a2f94f02-803f-446b-9dfd-5b9c4194beb4","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:ee70e27753269f723ba9b8a43d317e425f3425537fc059fa4f6d5f2f43ca62d3","observation_id":"ec2d39ab-24ad-413a-a623-5d625c900a98","resolution":{"observed_at":"2026-05-22T15:16:45.031478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpu mode","venue":null,"work_id":"0bc6f9f7-ad17-4809-831e-06df70881b8b","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:046b96b9ecf047a4145aee67b880a2172aa5b56269bc48e03ff3158e7a45c11e","observation_id":"8312f659-4f41-4e1f-93ca-68d13ad4d4e9","resolution":{"observed_at":"2026-05-22T15:16:45.221523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A fast quantum mechanical algorithm for database search","venue":null,"work_id":"c55c3972-36e6-4946-bdef-7407c9015b27","year":1996},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:207ecedc59cb7cdd075dc179e5fe738dabe8a72a1b6a00d5ddbd4b4b3a321217","observation_id":"59f7acce-7d3d-4318-a942-aa377f2b378b","resolution":{"observed_at":"2026-05-22T15:16:45.180790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:2e8a0a55a35a6f24b71f3dcb4d7cabbdca4d7415f668110f7e56ca96b63904f7","observation_id":"ffdcf185-4a76-4570-ad62-3705869d6d54","resolution":{"observed_at":"2026-05-11T12:26:08.144912Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e32e4508-4c5e-4b76-a6df-dc48cf389680","year":2007},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:8e582c67c260fc0e0fa61cfa90c458303e274984c5fd280c10eb491285d9ccbc","observation_id":"ca60d724-024a-4f26-8eb6-01a7cda6441b","resolution":{"observed_at":"2026-05-22T15:16:45.174404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08000","last_updated":"2016-09-23T07:18:03Z","snapshot_observed_at":"2026-07-06T05:12:12.264453Z","submitted_at":"2016-09-23T07:18:03Z","title":"The minimum overlap problem revisited","version":1},"cited_work":{"arxiv_id":"1609.08000","doi":null,"metadata_source":"pith","pith_arxiv_id":"1609.08000","snapshot_observed_at":"2026-07-03T15:18:33.547566Z","title":"The minimum overlap problem revisited","venue":"math.GM","work_id":"b39cd1ae-f6f5-4ff2-8cf9-3ad595c536a1","year":2016},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/1609.08000","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:5ee66b5b4123cbcd468580d9b807be9b5fb77eeefe1de99c1a4edf53340d27c5","observation_id":"c7c33485-8d64-4a62-9f0d-fb71fa44e974","resolution":{"observed_at":"2026-05-11T12:26:08.646405Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.4064/aa130-1-4","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Acta Arithmetica","work_id":"8bca5262-5fd7-4b08-a13c-fd6bf8c332a4","year":2007},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:16bb463d89f73ec58e0b236118af4340a770c0304d83247427489e63ab31d0e6","observation_id":"05813499-a15b-4e52-9728-4d9aea7c3287","resolution":{"observed_at":"2026-05-10T04:40:17.079483Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1155/2009/150624","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A literature review on circle and sphere packing problems: Models and methodologies","venue":"Advances in Operations Research","work_id":"691d674a-3146-4272-8792-e9a99135ab2e","year":2009},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:c120966f10324b720a815cf261f061d55c08e934861f6797b496f8d2d4731afa","observation_id":"f420a8eb-0531-42af-8beb-df20adb7fd78","resolution":{"observed_at":"2026-05-10T04:40:17.074342Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05004","last_updated":"2026-02-13T18:53:32Z","snapshot_observed_at":"2026-07-06T22:09:08.864232Z","submitted_at":"2025-08-07T03:38:16Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","version":4},"cited_work":{"arxiv_id":"2508.05004","doi":"10.48550/arxiv.2508.05004","metadata_source":"pith","pith_arxiv_id":"2508.05004","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","venue":"cs.LG","work_id":"45b39aae-1151-4087-9b48-dd16313e6306","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2508.05004","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:38bd1de938350754d6aec79feae742074f598f9c7585745647a6aeb7b5b633fe","observation_id":"139dcdf1-28f7-49d8-b460-4252fe0181bc","resolution":{"observed_at":"2026-05-14T19:23:29.765778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:06.742139+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:06.742139+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Olympiad-level formal mathematical reasoning with reinforcement learning","venue":null,"work_id":"60e56e48-2914-454f-ae1a-d03a19a4df68","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:52d24921d0995323d97bfdac6de88a11c22e59a3eea7006c0ec96d2780fb4015","observation_id":"f782cd44-7334-4fa6-b5c8-75b2cd9acbe3","resolution":{"observed_at":"2026-05-22T15:16:45.165136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ibm quantum computing: Hardware and roadmap","venue":null,"work_id":"a3894227-6d81-486b-b235-172260653e5e","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:ccacbb6569a7dd450909495fa34104078a197be7c4f7147623400231bf5c20eb","observation_id":"1f4697ef-6fd5-49f6-a349-c492f6be2535","resolution":{"observed_at":"2026-05-22T15:16:45.171488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1056/aioa2400555","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autonomous llm-driven research—from data to human-verifiable research papers","venue":"NEJM AI","work_id":"f8790572-c620-4e0a-a7f5-e90253c0df36","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:4c60f9238185ce1d6c301f2a77f4a2b2446d7af72d5f33c88649da4cb072d1ff","observation_id":"df1d04d2-06b0-4bdf-9430-9735bf65b2bd","resolution":{"observed_at":"2026-05-10T04:40:17.068664Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.09050","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:59:51.860763Z","title":"ALE-Bench: A Benchmark for Long-Horizon Objective-Driven Algorithm Engineering, October 2025.https://arxiv.org/abs/2506.09050","venue":null,"work_id":"8dd988c6-feec-4de9-b185-eb358e229675","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:57b48a37cea73c0e0ad6cd28409bbd20cd5e91241681ac7fea0b9bd155e24c09","observation_id":"b09d9aaa-10bb-4a18-8866-bcae6d79e13a","resolution":{"observed_at":"2026-05-11T12:26:05.480988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.04412","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:20:06.671442Z","title":"Wider or deeper? scaling LLM inference-time compute with adaptive branching tree search","venue":null,"work_id":"1182a806-301c-441c-a957-cfb9788e0234","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:e62f330ee271b8e1804b95548bc5b0473c06866707c42cdc87910dddfbbeb1d5","observation_id":"55926e4d-3c55-4a80-9345-f0954a512279","resolution":{"observed_at":"2026-05-11T12:26:05.622016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Algorithmic theory of qubit routing","venue":null,"work_id":"85c0ecc3-6f1a-45e3-be90-67004f0d4910","year":2023},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:5849882e8c93b0bed8193b11142f52c4dfdf563387174021f77df57341a17161","observation_id":"78f4ea20-06e3-4167-84af-824f30a3f2d7","resolution":{"observed_at":"2026-05-22T15:16:45.161725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:d9c6207105609c58e9ee6ecc446c5cdb362461a5d9d512cd75c3a14f00856549","observation_id":"81873db8-872f-4a9d-8e77-c7567edbb9af","resolution":{"observed_at":"2026-05-11T12:26:05.378793Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:6f78aaae9c2b51cadfbfe9c26a21b7657bb5135005ac951fd96aaae282264305","observation_id":"9ad75591-349d-4f50-b8c2-83ff000ad206","resolution":{"observed_at":"2026-05-11T12:26:08.697348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-10T22:08:12.954417+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T22:08:12.954417+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm-blender: Ensembling large language models with pairwise ranking and generative fusion","venue":null,"work_id":"da0b3163-a674-4de9-94c7-0373e8a18925","year":2023},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:8492bca8110ab6a4df4e08b8a3293356553644b137ccf8119aaaeda87eb839c7","observation_id":"ee98eb28-22d5-4458-9333-abc4709a21c9","resolution":{"observed_at":"2026-05-22T15:16:45.151062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SWE-bench: Can language models resolve real-world github issues? In The T welfth International Conference on Learning Representations","venue":null,"work_id":"e0721a38-c7c4-49e8-9d6b-128ed03a58a4","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:bfb95703a90a275b42e8d155d4e657692750c29012bb4574be9b2c1de557bc9b","observation_id":"4a9a6196-af9a-414b-b7be-929934094539","resolution":{"observed_at":"2026-05-22T15:16:45.154647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"autoresearch: A simple and eﬀicient AI agent for autonomous ML research","venue":null,"work_id":"870f1f4a-e593-4c08-b764-aefd844778c9","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:7000b3235e4951697f05a707a8c4b0eeaecd8d7cf1b200318a36f9e3d4d126c0","observation_id":"baced48d-69f3-4d70-ab8d-69449b473702","resolution":{"observed_at":"2026-05-22T15:16:45.158386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.08296","last_updated":"2026-04-08T21:31:49Z","snapshot_observed_at":"2026-08-12T20:57:33.174036Z","submitted_at":"2025-12-09T06:52:21Z","title":"Towards a Science of Scaling Agent Systems","version":3},"cited_work":{"arxiv_id":"2512.08296","doi":"10.48550/arxiv.2512.08296","metadata_source":"pith","pith_arxiv_id":"2512.08296","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Towards a Science of Scaling Agent Systems","venue":"cs.AI","work_id":"df1c366f-f1cf-469a-b862-5d59229b6b8f","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2512.08296","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:87bcae920b09b659069417eb1779fd4fd7006008d650fa7defb7d1a58e46e604","observation_id":"bb3b15c0-c02f-4403-b3cb-c7ea85265808","resolution":{"observed_at":"2026-05-11T12:26:06.654988Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Superconducting qubits: Current state of play","venue":null,"work_id":"18982475-e93c-4f2e-a291-ff9dab8f6021","year":2020},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:af6761c8f0bb3695ec524aff881e197fe815d3dc88bea7c96fe031876daf7817","observation_id":"674dda31-5d84-4b4b-b1bc-ed481083046c","resolution":{"observed_at":"2026-05-22T15:16:45.168320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2509","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T01:29:21.735392Z","title":"https://doi.org/10.48550/arXiv.2509","venue":null,"work_id":"dde53a84-8dc6-4f50-98b8-df0d46054c9e","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:8c8e46378c774c5f96aa1dc91137877a5a776e194820400909d3f5e36d978fc0","observation_id":"291f8c0e-0de7-4263-a0ba-b12b51c03ce2","resolution":{"observed_at":"2026-05-10T04:40:17.090521Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-20T17:52:26.422976+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-20T17:52:26.422976+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"edu/9780262","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:16:42.451292Z","title":"The Theory of Industrial Organization","venue":null,"work_id":"6aa76c7e-e330-40e7-add9-97ecb5421bc2","year":2018},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:763360352a4bb35a7b6cdc5d14e10264ba037f27265dab4b477cb82496dfac48","observation_id":"9a5de168-1ba0-4c04-8be2-17a9de22eb86","resolution":{"observed_at":"2026-05-11T12:26:06.755919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qasmbench: A low-level quantum benchmark suite for nisq evaluation and simulation","venue":null,"work_id":"add3b5b9-7314-4713-a266-21d09bf13eb8","year":2023},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:3f8823db9deb66d9e2a702f6fc19a45b621b2818d25c465f58faf408890e6cff","observation_id":"ac47f305-6769-4fc1-8206-73da840d7bda","resolution":{"observed_at":"2026-05-22T15:16:45.191888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tackling the qubit mapping problem for nisq-era quantum de- vices","venue":null,"work_id":"536e47fb-4440-4af8-a7aa-35bb1f6751ab","year":2019},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:abb8096d83a8ffeb87df9da99328f23b1b4806331001519d40f834f3672ee7a1","observation_id":"fe0454f2-f1ec-421c-b5b3-66beb7306e78","resolution":{"observed_at":"2026-05-22T15:16:45.114445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Predictable scale: Part i–optimal hyperparameter scaling law in large language model pretraining","venue":null,"work_id":"0df315ae-dd0b-41df-a008-6de0f3620cfb","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:ebc5ccc9e106cab62eeeb97d1d3ca5574b4eba9b3b61387691fcb610448445b1","observation_id":"76044307-c886-4169-91c9-a3bc1b7a8459","resolution":{"observed_at":"2026-05-22T15:16:45.124301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Selecting large language model to fine-tune via rectified scaling law","venue":null,"work_id":"4c95be23-3ae5-436c-a0ad-2d7634845128","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:34c1a7d441f6600dbf22f0a0f317b92f52874b7193c46d847ff3323872c6cb6e","observation_id":"b7c76577-63f2-4312-911c-f2bbc722b544","resolution":{"observed_at":"2026-05-22T15:16:45.128014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"19da4d22-efc4-4aff-8ac6-6798ffc23455","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:e87cf5e8b700df2b2bc1ed37d4f27be6fb38c5d22b8a43eeb895589382a01a85","observation_id":"e70707f2-16e8-48d2-ba21-ee0ea8bf1e4f","resolution":{"observed_at":"2026-05-22T15:16:45.145226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reuse-aware compilation for zoned quantum architectures based on neutral atoms","venue":null,"work_id":"2c535fe7-7443-4d27-9f37-f1d1b464f70f","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:4e391be0ef475731bd3b856daa7de8e5c745dfc206237d1386efa774b2598743","observation_id":"a763d2c6-7154-41a4-90cb-c76244bd51e4","resolution":{"observed_at":"2026-05-22T15:16:45.131890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zero-preserving imputation of single-cell rna-seq data","venue":null,"work_id":"c9cbf78f-3f46-4080-9ffa-bc746fc61505","year":2022},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:d435318eb66002c7209abb8e3d442be02c55c398926c5d3322488dae677f181c","observation_id":"15d8fc33-7953-4a0e-8ebf-b525afab8da3","resolution":{"observed_at":"2026-05-22T15:16:45.118836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.23413","doi":"10.48550/arxiv.2602.23413","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pan, Alexander Du, Kurt Keutzer, Alvin Cheung, Alexandros G","venue":"Open MIND","work_id":"95fde239-55f9-4815-bb8b-0dc0ce46c0aa","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:9274feb0a63f35b0780bb6b1da858299272d15d9f00066a26042b2c613732c1d","observation_id":"4ff975c3-c792-4454-88e8-fe1a88e16292","resolution":{"observed_at":"2026-05-10T04:40:17.094988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.17006","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Budget-aware tool-use enables effective agent scaling","venue":null,"work_id":"2e898cde-a955-47ad-9d56-899dcf21db89","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:193e4c0c97f2e468e3e59fc229628319bd492c3a8e3499fec49fe6651550d410","observation_id":"49a8fc4c-8792-4da3-9789-55163a4e276e","resolution":{"observed_at":"2026-05-11T12:26:05.522817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Universal quantum simulators","venue":null,"work_id":"50cc32cb-dba5-4d0e-846e-dbc7e6b74a74","year":1996},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:6c86d7e3e2a5d7320e72aba862ef6f29aad4d0b41e8f62c75f8d5f5cb3a78b2b","observation_id":"b85cdcc3-48d1-4095-a1bd-80bffcb83020","resolution":{"observed_at":"2026-05-22T15:16:45.135634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-026-10265-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https: //doi.org/10.1038/s41586-026-10265-5","venue":"Nature","work_id":"4d3fbb7a-cc54-4c34-8c96-b78f73ffd417","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:71e7d52a927111b20d7008f0d3496cb8d08d26b1de50bba4279973c5d2140242","observation_id":"bdce4baf-6fea-4aff-983a-d38b6489d988","resolution":{"observed_at":"2026-05-10T04:40:17.055505Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-14T12:20:08.100902+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T12:20:08.100902+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Current best practices in single-cell rna-seq analysis: a tutorial","venue":null,"work_id":"9e11f1a6-1e95-415a-bdc5-632e572569dd","year":2019},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:ed4d1ad3fb50146b377092a3f6c4602e32d5e958bdaf43df534bea643f607434","observation_id":"9968a275-80ef-4a18-8fc7-4bc2bbe6123d","resolution":{"observed_at":"2026-05-22T15:16:45.006513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Defining and benchmarking open problems in single-cell analysis","venue":null,"work_id":"813034c5-669e-4923-b562-9666a3745526","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:e6120238179133c9e95e6e9e89da54bc5dbfc28978dd1065d0d44857584d9fc9","observation_id":"5e899333-16a0-42e9-95de-2e90def59544","resolution":{"observed_at":"2026-05-22T15:16:45.148073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Highly parallel genome- wide expression profiling of individual cells using nanoliter droplets","venue":null,"work_id":"9813c98c-a63a-4079-bd7a-7031651489db","year":2015},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:8ff8347edc2366ceda0d304c5c50a05002127a710c0be39a99eab6b654d61667","observation_id":"4d5b96df-459c-48d9-991e-130197aa7a30","resolution":{"observed_at":"2026-05-22T15:16:45.100106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self- refine: Iterative refinement with self-feedback","venue":null,"work_id":"efc35dff-8ca8-47d6-8d46-1369f1b317ba","year":2023},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:9e09ca2cd2d4a24dda4979e5669ec34920b5b1c0633b5e1fe973d3e1c931ec9e","observation_id":"0ae6461f-2cb4-4070-a569-59e4e28eef44","resolution":{"observed_at":"2026-05-22T15:16:45.103500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pólya urn models","venue":null,"work_id":"c7fe3f1f-bfb8-42fa-8a28-072d58a74d8a","year":2008},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:e48764426de7f5d964ee4af474f90ed331b508927b743e5845bf4a8e24be1069","observation_id":"4a2dd703-7a04-4009-85c0-3799423ef3be","resolution":{"observed_at":"2026-05-22T15:16:45.088973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"math/0608131","last_updated":"2006-12-04T04:05:22Z","snapshot_observed_at":"2026-07-07T05:59:19.952128Z","submitted_at":"2006-08-04T19:57:11Z","title":"Many sets have more sums than differences","version":3},"cited_work":{"arxiv_id":"math/0608131","doi":null,"metadata_source":"pith","pith_arxiv_id":"math/0608131","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Many sets have more sums than differences","venue":"math.NT","work_id":"5585e826-1723-4bca-99b2-41cc50b5f92b","year":2006},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/math/0608131","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:ae18f269471140b062e28595383ef35bbea05e0c5ffcbb15e7c07118bec1cc1d","observation_id":"6176f69c-0b38-4dbb-a25c-e42ca23c1285","resolution":{"observed_at":"2026-05-11T12:26:08.296697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved bounds on the supremum of autoconvolutions","venue":null,"work_id":"e123e8bf-cc33-4061-9d4f-adcb29e3a47b","year":2010},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:bedd9228dfec6ebda173b2cf1391ea37c4f9fc79d8f4b81552df646ff421cdc5","observation_id":"86082eec-50f8-4492-9683-de3878647a85","resolution":{"observed_at":"2026-05-22T15:16:45.092866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15411","last_updated":"2026-04-16T16:22:04Z","snapshot_observed_at":"2026-07-06T23:02:58.361418Z","submitted_at":"2026-04-16T16:22:04Z","title":"PRL-Bench: A Comprehensive Benchmark Evaluating LLMs' Capabilities in Frontier Physics Research","version":1},"cited_work":{"arxiv_id":"2604.15411","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.15411","snapshot_observed_at":"2026-07-05T17:51:14.781135Z","title":"PRL-Bench: A Comprehensive Benchmark Evaluating LLMs' Capabilities in Frontier Physics Research","venue":"cs.LG","work_id":"9bd5826e-6e92-442f-a619-31b1f9ddd217","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2604.15411","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:bc3cfcdae5e56e12a341d2f15a4b7cb361c603e775e648056b7e3650441bf213","observation_id":"10f95797-1de5-40d8-bdfb-e3e95e05d4a3","resolution":{"observed_at":"2026-05-11T12:26:06.895857Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1025","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S1: Simple test-time scaling","venue":null,"work_id":"16de4a03-b204-42b7-ab29-734d87b8cd33","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:8f8bcdad12b00ddf1c4bdb321b9c2a4dbfcc731381f63f8ece67d6f0b309b555","observation_id":"ec4a44bc-65c9-48b2-9e33-a2fe623ef601","resolution":{"observed_at":"2026-05-10T04:40:17.076103Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-16T19:20:54.872421+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T19:20:54.872421+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Noise-adaptive compiler mappings for noisy intermediate-scale quantum computers","venue":null,"work_id":"611bea2a-0726-4fb1-943d-4050e49f81d0","year":2019},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:0e02eab2686bea1f9dd35771eff19664c718f1bc9a7e61747ca90482e4ef1767","observation_id":"e8f7c671-905d-4891-a02e-9775cb43f3c0","resolution":{"observed_at":"2026-05-22T15:16:45.096543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimal qubit assignment and routing via integer programming","venue":null,"work_id":"0896532c-feb0-445f-be34-035fe40162bb","year":2022},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:3fa234a556767ee9d6325948337e9a4e4ee1536997e0ec5b97ddddadb08142c8","observation_id":"cddeca21-36b7-472f-9bdb-c0dc7ac9c25b","resolution":{"observed_at":"2026-05-22T15:16:45.106892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The ibm quantum heavy hex lattice, July 2021","venue":null,"work_id":"4cb4896f-0d9d-4c2a-9b19-78d65b25c8d1","year":2021},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:9dbe74b826ae82f93cc8be72e78a805b929e6fc6da80aadd8ec9d698952c56a1","observation_id":"eb7ee6d0-36e9-4cf7-afa6-77c054e2fe5e","resolution":{"observed_at":"2026-05-22T15:16:45.142403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantum computation and quantum information","venue":null,"work_id":"ab568854-2a7e-488e-b38a-1654e5d68b14","year":2010},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:2b0a9b59e75953ecfa8bdfaaa5bc09450469ba0727597339b1297be497e17a8c","observation_id":"10775971-edb8-49b4-aff9-0b49b1043aa5","resolution":{"observed_at":"2026-05-22T15:16:45.082160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-08-11T23:48:15.512738Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":"2506.13131","doi":"10.1016/j.shpsa.2017.03.005","metadata_source":"pith","pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","venue":"cs.AI","work_id":"76a0f850-d490-4e4f-ab98-8d25df82cd23","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:3f4e0b460ca0e9a1c0fd0949b1f9942a24fdc370855b0a9f8db1b8894f56cc3e","observation_id":"f09048fb-d0fa-48a2-b199-3e899804ad16","resolution":{"observed_at":"2026-05-11T12:26:07.795911Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CUDA Core Compute Libraries (CCCL): Including CUB, Thrust, and libcudacxx","venue":null,"work_id":"87844c82-8cb1-4f18-bbcf-1cfe8f503ecc","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:018de41b10cf26b2be252568195e1e7011fbe33cbea002873b540ce5cee77bad","observation_id":"43e9ba98-9b25-47d3-b52d-ab8511e24122","resolution":{"observed_at":"2026-05-22T15:16:45.085715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"gpt-oss-120b & gpt-oss-20b model card","venue":null,"work_id":"4446a995-8dc2-4c6a-883d-95b3d0d7987e","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:3bff6c5d9c01b71da07f970b7c2470f7e5306474ecbf0e80d329bb1dca508c27","observation_id":"c5280c11-5d33-4c39-bcb6-7e60e296eeb2","resolution":{"observed_at":"2026-05-22T15:16:45.066763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"math/0304410","last_updated":"2003-04-25T16:13:59Z","snapshot_observed_at":"2026-07-07T05:34:43.101885Z","submitted_at":"2003-04-25T16:13:59Z","title":"New lower bounds for the maximal determinant problem","version":1},"cited_work":{"arxiv_id":"math/0304410","doi":null,"metadata_source":"pith","pith_arxiv_id":"math/0304410","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"New lower bounds for the maximal determinant problem","venue":"math.CO","work_id":"40581eb3-e334-4d39-9eca-ff5ebac92d19","year":2003},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/math/0304410","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:46c0988735af259a491da37ba3ddcabbcf8277eea6508f487a4e59c106c1dc8a","observation_id":"38ad90e4-58bf-4fb6-bb71-f6a676ce20f1","resolution":{"observed_at":"2026-05-11T12:26:05.390615Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10517","last_updated":"2025-02-14T19:30:53Z","snapshot_observed_at":"2026-08-11T09:07:12.560478Z","submitted_at":"2025-02-14T19:30:53Z","title":"KernelBench: Can LLMs Write Efficient GPU Kernels?","version":1},"cited_work":{"arxiv_id":"2502.10517","doi":"10.48550/arxiv.2502.10517","metadata_source":"pith","pith_arxiv_id":"2502.10517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"KernelBench: Can LLMs Write Efficient GPU Kernels?","venue":"cs.LG","work_id":"ee44d624-1355-4fa0-ad70-c89205f5ce5a","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2502.10517","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:6e18953840c1c5ecff7f10fe4a2b07fe895eb9082667bf4fa62c7c2fcdd25529","observation_id":"ceae6b10-984c-4a2d-961e-09948aed6134","resolution":{"observed_at":"2026-05-15T16:55:02.220088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:30:06.904853Z","title":"Yifan Li, Yifan Du, Kun Zhou, Jinpeng Wang, Xin Zhao, and Ji-Rong Wen","venue":null,"work_id":"8122370e-553b-4d6f-b1a8-98e24c010366","year":2023},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:aae0f7c350a86560ee0127b5a576b92136555e21c8726ddc4a2eda6e65736eee","observation_id":"07c9b7eb-b948-4a73-a89b-de61fe8a9060","resolution":{"observed_at":"2026-05-10T04:40:17.083844Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-03T20:08:10.998972+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T20:08:10.998972+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bfb0113271","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Packing circles in a square: A review and new results","venue":"Lecture notes in control and information sciences","work_id":"58067ef0-7007-45b8-8fce-89ae26cd9bd4","year":1992},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:88b938b144bde63aeed757a04abb23c9b5d9f1b7449ad256d033c5161c4b10b1","observation_id":"de2ef440-c998-4643-a089-15486f3e2455","resolution":{"observed_at":"2026-05-10T04:40:17.077974Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Using reinforcement learning to perform qubit routing in quantum compilers","venue":null,"work_id":"c595cc6f-f811-4a8f-a459-e678bf72e5d5","year":2022},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:a4935771c2b6ca3ab6cfad169824c001e3f44a777f2c68c4d20e35a549b31009","observation_id":"979f620e-62d6-4e6b-ab8e-a7038cb86c12","resolution":{"observed_at":"2026-05-22T15:16:45.059453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantum computing in the nisq era and beyond","venue":null,"work_id":"f8e078ed-c8f1-48c0-b0b5-a409e9a9e858","year":2018},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:6f7a73a8bb2f5415083134dee1fbcf0771c5e32f279c0321bc93730933178b87","observation_id":"d3d0d00a-ca29-49f4-a128-612e14826531","resolution":{"observed_at":"2026-05-22T15:16:45.078224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:30:37.322528Z","title":"Beyond nisq: The megaquop machine","venue":null,"work_id":"6f9df8d5-1aee-4f0e-90e5-fcc38a948193","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:9feb545b73109d7e372bb7a828496aafc824c4a78d533eee97062ad61528d893","observation_id":"5cc80e23-26fa-4b5c-bbba-c7fa15a0271a","resolution":{"observed_at":"2026-05-22T15:16:45.224252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.15887","doi":"10.48550/arxiv.2507.15887","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"K., Krupke, D., Kidger, P., Sajed, T., Stellato, B., Park, J., et al","venue":"ArXiv.org","work_id":"2c25f9d0-1696-48ff-a3b2-38c2e0d862c1","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:c4394d495bc2485bb5cd229ce4ab536f52cb493164478bf1a3cfb38ed16c9a84","observation_id":"26457806-d25f-41d2-8006-716c453e612b","resolution":{"observed_at":"2026-05-11T12:26:05.419347Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.01658","last_updated":"2026-05-17T15:53:43Z","snapshot_observed_at":"2026-08-02T10:30:49.400581Z","submitted_at":"2026-04-02T05:59:06Z","title":"CORAL: Towards Autonomous Multi-Agent Evolution for Open-Ended Discovery","version":2},"cited_work":{"arxiv_id":"2604.01658","doi":"10.48550/arxiv.2604.01658","metadata_source":"pith","pith_arxiv_id":"2604.01658","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CORAL: Towards Autonomous Multi-Agent Evolution for Open-Ended Discovery","venue":"cs.AI","work_id":"768a7d33-64e6-43f5-90d2-edcd46f4b957","year":2026},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2604.01658","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:89b57b587a8a74cf82e0b62781ffc8a39d8fa4d267e37db71d7cd2627e0b733e","observation_id":"bd768c9d-261f-439b-b4e9-0e9fbf1be608","resolution":{"observed_at":"2026-05-20T00:04:30.475245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mqt bench: Benchmarking software and design automation tools for quantum computing","venue":null,"work_id":"3e2bc624-5410-4ab6-b245-0e9b65469d9f","year":2023},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:e84865f934455f73b6bbbabb1f9794a181ac68da84cc722fc5c6229c2e70d48a","observation_id":"35157c2f-0f51-4ba7-bb7e-f159458dee36","resolution":{"observed_at":"2026-05-22T15:16:45.012634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":2,"verified_exact":39,"verified_fuzzy":50},"total_outbound_references":188},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 100 of 188 outbound references and 15 inbound Pith citation observations for arXiv:2604.19341."}