{"as_of":"2026-08-20T01:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:40c02deba01221e1c5ce88eadc640109081f3d695cde514d49974440d822d2e5","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:31:05.820448Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09855/citation-record","integrity":"/paper/2608.09855/integrity","json":"/paper/2608.09855/citation-record.json","paper":"/paper/2608.09855"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.284651Z","title":"AGI House community newslet- ter, July 23, 2026","venue":null,"work_id":"ace6f53c-1fe0-4230-b280-bf9e8daf72bd","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.474864Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:79fe738c2b9b31ef69a97d32c3f6200006381f12809fcaaed7fbba65f5e3c318","observation_id":"292ebfa1-7f72-4bc2-87f7-6e581460cfb1","resolution":{"observed_at":"2026-08-11T05:31:07.300725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.272058Z","title":"X article, July 31, 2026","venue":null,"work_id":"863c3b25-e70d-4ea4-a8f0-b3d7ac190d87","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.482020Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:438dd7b6465864972aadde99d2331c9c21646487ed4936758b596917eede278d","observation_id":"6ac6cdd4-2481-4035-8bad-7ff08b6c7441","resolution":{"observed_at":"2026-08-11T05:31:07.276062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.486529Z","title":"The Oracle Problem in Software Testing: A Survey","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.486529Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:db536aca0bb258585e785c943dc706aeb28624ba10c3cfe0a1e753ab5ac55b1e","observation_id":"2f73d93d-d090-49d4-9682-0d0eae95e7c3","resolution":{"observed_at":"2026-08-11T05:31:05.486529Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.492817Z","title":"Directed Greybox Fuzzing","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.492817Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:653e8e1ac0bc3bd6faf5e30c302d506efcb68af1b50d3d3f67436053e5da7532","observation_id":"d2a70ac0-3003-416b-a903-20801523b956","resolution":{"observed_at":"2026-08-11T05:31:05.492817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.499251Z","title":"Coverage-based Greybox Fuzzing as Markov Chain","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.499251Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:abc1be4df9080e7d3593fed61afc381bfa03d0ea28f9a4a8fbd03ad866bee5c5","observation_id":"1f4fe1fe-efcd-4209-a3e8-3629bd64317d","resolution":{"observed_at":"2026-08-11T05:31:05.499251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.505312Z","title":"On the Re- liability of Coverage-Based Fuzzer Benchmarking","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.505312Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:689fc7978a06f0eeb9f33df78c930568b9946a6c49b66098627ae48364b0c780","observation_id":"a92efadc-d01a-4c47-85c6-4a2ae51b0c2f","resolution":{"observed_at":"2026-08-11T05:31:05.505312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.513125Z","title":"Autonomous chemical research with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.513125Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:a162c482162c85f3feb02ed6827f1662dbaa0fefc12f6d0e57f22ce84a60dabd","observation_id":"197419a9-810d-452a-bbbd-e2cc95ca7a1d","resolution":{"observed_at":"2026-08-11T05:31:05.513125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-08-14T10:00:52.343929Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-11T05:31:05.520379Z","title":"Large Language Mon- keys: Scaling Inference Compute with Repeated Sam- pling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.520379Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:df61abd8fa91b5c3feb58736a067cfe1721706184b0bde781d5154d8f9202098","observation_id":"da915752-7dbf-4c1e-87e4-1b24e634bf34","resolution":{"observed_at":"2026-08-11T05:31:05.520379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.260145Z","title":"Exploration by Random Network Distillation","venue":null,"work_id":"94bd315f-e4c9-4a14-a96d-e2f38c446f56","year":2019},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.525497Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:c343b1a550b9323d29af2f9d6afe0c7296524a45babdc573437acfa22336cd85","observation_id":"848b6abf-4416-4809-b1f5-cbb32fc53c91","resolution":{"observed_at":"2026-08-11T05:31:07.264602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.248474Z","title":"MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research","venue":null,"work_id":"ad644905-8973-4146-8cbb-eca6c238ee23","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.530560Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:83b74ef4f2fdf73c0bd7fb158b76bbe7459e68b2ebc1c1aa32c800d2321187d7","observation_id":"f2aed3c9-32e4-49ad-85e1-5b9a0dae752a","resolution":{"observed_at":"2026-08-11T05:31:07.252612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.540695Z","title":"Angora: Efficient Fuzzing by Principled Search","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.540695Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:19d7a6ea8c78a4df5668fb080894aa71456da89517bbdbf851baeef7088f68ee","observation_id":"c902bab6-ca3a-4851-9532-99ce31a16992","resolution":{"observed_at":"2026-08-11T05:31:05.540695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.235850Z","title":"An Unsolvable Problem of Elementary Number Theory","venue":null,"work_id":"5de519ff-0a86-4b90-b3f5-45e78e32c9cd","year":1936},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.545246Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:456ea00d20197d90b6436c20432b04790e9e5d5e3792fe29c48615b57d8c92e5","observation_id":"3cbf85b9-46ac-48e7-9df4-9d7406a94f51","resolution":{"observed_at":"2026-08-11T05:31:07.239946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.223244Z","title":"The reusable holdout: Preserv- ing validity in adaptive data analysis","venue":null,"work_id":"74e05cad-59e6-45e4-a3fb-1b2ecfbec138","year":2015},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.549624Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:a6628544a076dadd965a1a260e06eef62428088273480a96e362a44ece1a3921","observation_id":"88b556f3-9e90-4b39-8704-bc037375b9b7","resolution":{"observed_at":"2026-08-11T05:31:07.227165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.557241Z","title":"Transforming Science with Large Language Models: A Survey on AI-Assisted Scien- tific Discovery, Experimentation, Content Generation, and Evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.557241Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:54aecbf4edb145311879fb56512f4f664059004bbda7c6994fae660d1ed29ed7","observation_id":"cede52f7-c5b1-4f8a-a549-c5468ecb9208","resolution":{"observed_at":"2026-08-11T05:31:05.557241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.209675Z","title":"AFL++: Combining Incremental Steps of Fuzzing Research","venue":null,"work_id":"ed4e1b1c-44d0-4d19-aac6-1b269e4bf4f7","year":2020},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.562995Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:e95f94d2db4386d4c1b5fe02cbc95c829885e62f007d61b9a78ebc549c3f6a5c","observation_id":"ede82e73-2a80-4f52-a927-6c403a586144","resolution":{"observed_at":"2026-08-11T05:31:07.214798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.197357Z","title":"A Learning Machine: Part I","venue":null,"work_id":"d2139e33-0c5d-40c0-b6ed-18dd2e570668","year":1958},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.568749Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:162e7dec1fcc2d587d8856203d987338805bad1b81367b1bbbd3efd656690435","observation_id":"6a2fcbb3-66ec-452c-9111-acaf35f683f9","resolution":{"observed_at":"2026-08-11T05:31:07.201753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.185010Z","title":"Scaling Laws for Reward Model Overoptimization","venue":null,"work_id":"c7b28930-4ccd-4536-80e1-fa0eec981dc3","year":2023},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.576690Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:54c90081c37f389fe481938e0eb9319f8f0ea696bdfed73f8e90e8790fc4e7bb","observation_id":"8b7caed5-02f5-4f46-b52b-e337cfeaa2b6","resolution":{"observed_at":"2026-08-11T05:31:07.189026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.172339Z","title":"Über formal unentscheidbare Sätze der Principia Mathematica und verwandter Systeme I","venue":null,"work_id":"aaa53a4b-d25d-4fc3-9e40-1455950e8490","year":1931},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.583105Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:f98c77cc773a03032aeb7eedae20dff6355cd74ee0e63d12dbd4156d06904db1","observation_id":"dad6d249-a49c-4167-ad5a-125044987bd5","resolution":{"observed_at":"2026-08-11T05:31:07.177014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.160332Z","title":"Speculations Concerning the First Ul- traintelligent Machine","venue":null,"work_id":"059dbf76-a59e-4f87-b101-cb895d143cca","year":1966},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.588273Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:3c95d9fd5974433a494979a007dfe6366bbdfb1cd1347c2e6e74219943500f59","observation_id":"3e3f8bcf-89a8-4b43-8905-4c9519949ef4","resolution":{"observed_at":"2026-08-11T05:31:07.164986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.147079Z","title":"Accelerating Scientific Discov- ery with Co-Scientist","venue":null,"work_id":"a453866c-1dc9-4da9-b26d-101d1b948d9f","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.596213Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:4f40a69d3aa5332f65dd13378a13f24ffc6c3f0ac3a4af6f1937e5e1971b64ad","observation_id":"c6f72cb1-493e-40f9-8061-d23580ada192","resolution":{"observed_at":"2026-08-11T05:31:07.152370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.133987Z","title":"Content Fuzzing for Escaping Information Cocoons on Digital Social Me- dia","venue":null,"work_id":"0cc559f1-b3ce-43c1-9062-dba1a89757a1","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.601942Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:7588c306e65a7de404853651c545011573b2e975cd19537d1d3202f1d144bff2","observation_id":"f7f6ac98-434c-4547-aa7a-19dfccbbf9a7","resolution":{"observed_at":"2026-08-11T05:31:07.138796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.119471Z","title":"MLA- gentBench: Evaluating Language Agents on Ma- chine Learning Experimentation","venue":null,"work_id":"d7299f55-f19b-4c7e-bdc3-f735f4a185a7","year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.607908Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:461ac932abf5342cc65033475e654aa069069572f9738e2a0675098931484384","observation_id":"e656f7f1-c5a5-4d42-9f9b-a98aa3d0b9be","resolution":{"observed_at":"2026-08-11T05:31:07.124405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.104908Z","title":"ALE-Bench: A Benchmark for Long-Horizon Objective-Driven Algorithm Engineer- ing","venue":null,"work_id":"4118d25d-4f60-479c-8978-250e310aa2f5","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.614392Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:f3a922eb82f4d201668f534b2e8b306c0db0db591bdb4effdac361e3b66ac4b6","observation_id":"d1bdcd0c-ed0e-4271-8342-d7129988cbda","resolution":{"observed_at":"2026-08-11T05:31:07.109605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.625385Z","title":"Evaluating Fuzz Testing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.625385Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:3ee679a75a34f267462baa1c937fc8939bc1e89f30babfa8ec3b14b5cf3297ac","observation_id":"4f31befa-86ef-4230-803c-aa057a7b681d","resolution":{"observed_at":"2026-08-11T05:31:05.625385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.630357Z","title":"Abandoning Ob- jectives: Evolution through the Search for Novelty Alone","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.630357Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:fe937b21c04be0f13cebd9bcc9035850ab078d0703bf11af7a407dd03526dfc9","observation_id":"dcf6a9a9-5092-4591-b094-b579a35317bb","resolution":{"observed_at":"2026-08-11T05:31:05.630357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.636111Z","title":"On a Measure of the Information Provided by an Experiment","venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.636111Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:0d507955ada1fd54ac47566307fc0c3148a3a76e77ebba5aa52acdb6861c81be","observation_id":"327d5189-2323-4076-8437-2fc726dd5868","resolution":{"observed_at":"2026-08-11T05:31:05.636111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24658","last_updated":"2026-05-19T16:11:13Z","snapshot_observed_at":"2026-07-06T23:10:38.548416Z","submitted_at":"2026-04-27T16:23:09Z","title":"The Last Human-Written Paper: Agent-Native Research Artifacts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24658","snapshot_observed_at":"2026-08-11T05:31:05.643545Z","title":"Liu et al.The Last Human-Written Paper: Agent- Native Research Artifacts","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.643545Z"},"links":{"cited_paper":"/paper/2604.24658","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:f88e5b500e766f8a7387d58287bfacb796571e5b8e0ddacbaffbd498e16660e1","observation_id":"a2497f5c-202b-43aa-aa18-6c23d1e1bbe1","resolution":{"observed_at":"2026-08-11T05:31:05.643545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11910","last_updated":"2024-11-24T12:59:44Z","snapshot_observed_at":"2026-08-18T03:56:12.036803Z","submitted_at":"2024-11-17T13:40:35Z","title":"AIGS: Generating Science from AI-Powered Automated Falsification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11910","snapshot_observed_at":"2026-08-11T05:31:05.649250Z","title":"AIGS: Generating Science from AI- Powered Automated Falsification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.649250Z"},"links":{"cited_paper":"/paper/2411.11910","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:de284cfaa21be8bab0321a0fa3e9e173278bd9d821b6f5f5a09f6009f3d8c7fd","observation_id":"84105d83-9e65-4b30-9c70-4308e6a3555a","resolution":{"observed_at":"2026-08-11T05:31:05.649250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-11T05:31:05.654896Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.654896Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:dac0f3ceb5cb7b9fecbde9210950c800b7e62cb9ec9ae2a2999eefedc8f25f7f","observation_id":"55cbf69a-8c55-4d52-8ceb-9c52824d2ebc","resolution":{"observed_at":"2026-08-11T05:31:05.654896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.662457Z","title":"Prompt Fuzzing for Fuzz Driver Generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.662457Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:0dba78eceadbbe88a266ec56f10f6efee131428e27aa8b81e78e77d4adf92c19","observation_id":"69810099-83c5-4f73-be78-5b1523a4639b","resolution":{"observed_at":"2026-08-11T05:31:05.662457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.091386Z","title":"The Art, Science, and Engineering of Fuzzing: A Survey","venue":null,"work_id":"81b24e14-095c-44a1-99ae-203a0c713855","year":2021},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.667879Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:e9b007a619022a44ed78c9cecc865d984ee591a4a94c4c6466c0f91597ce59f7","observation_id":"a878b3ff-5be8-4d0f-aad0-48bd62ddb05e","resolution":{"observed_at":"2026-08-11T05:31:07.095488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.04909","last_updated":"2015-04-20T01:17:00Z","snapshot_observed_at":"2026-08-15T13:07:45.856087Z","submitted_at":"2015-04-20T01:17:00Z","title":"Illuminating search spaces by mapping elites","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.04909","snapshot_observed_at":"2026-08-11T05:31:05.672812Z","title":"Illuminating Search Spaces by Mapping Elites","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.672812Z"},"links":{"cited_paper":"/paper/1504.04909","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:de8b76973dfe9206e1119e07a4933c04cb9633426051846359f94958da04eacf","observation_id":"abe0c065-81c7-4daf-8def-71ea10c51c1f","resolution":{"observed_at":"2026-08-11T05:31:05.672812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-08-11T23:48:15.512738Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-11T05:31:05.680580Z","title":"AlphaEvolve: A Coding Agent for Scientific and Algorithmic Discovery","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.680580Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:eb3e9a42cce73ff68e6a0e3e67062b45051e5fd88248c81142e5763f5ea2c7d1","observation_id":"edd5b415-64f5-40d3-a714-1412535c893f","resolution":{"observed_at":"2026-08-11T05:31:05.680580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.076713Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","venue":null,"work_id":"f27556d4-f3dc-4d87-b0db-08dd25580333","year":2022},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.685691Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:be9ac4ac41b1caf9dad1a0628668939b0baee78f3939d085166d9d8bee0d5e49","observation_id":"98d154a7-a2de-464c-bff0-1719fca737e8","resolution":{"observed_at":"2026-08-11T05:31:07.081520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.062214Z","title":"LLM Evaluators Recognize and Favor Their Own Generations","venue":null,"work_id":"e8bd44ea-baa3-488d-b8dc-822938889ea6","year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.689743Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:f9cc2ea8322f01ce7562bbb9c63234d5ff60f5aae55e4ed2e85573b7cdabc6a3","observation_id":"1b570125-e1be-4fa7-8aae-274736b48b0b","resolution":{"observed_at":"2026-08-11T05:31:07.068448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.05363","last_updated":"2017-05-15T17:56:22Z","snapshot_observed_at":"2026-08-14T21:00:36.063090Z","submitted_at":"2017-05-15T17:56:22Z","title":"Curiosity-driven Exploration by Self-supervised Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.05363","snapshot_observed_at":"2026-08-11T05:31:05.693685Z","title":"Curiosity-driven Exploration by Self-supervised Pre- diction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.693685Z"},"links":{"cited_paper":"/paper/1705.05363","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:2fe62d7ab51fd754d8f0cea5e9e47342fa56d0ba921f693c6e6e33ef165b7fcb","observation_id":"dcbec012-f47d-4d52-8eca-1f097e44a7c4","resolution":{"observed_at":"2026-08-11T05:31:05.693685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.698039Z","title":"Modern Bayesian Experimental De- sign","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.698039Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:89adb0775a4a7ad43afee4e14bad6ca49a67945389cdaf194960b1dbe0310730","observation_id":"41b61815-a489-4a45-9912-ca47b4969ff3","resolution":{"observed_at":"2026-08-11T05:31:05.698039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.046013Z","title":"Towards Scientific Dis- covery with Generative AI: Progress, Opportunities, and Challenges","venue":null,"work_id":"c5415bad-54b6-484b-8e39-603fe1aea6dd","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.701986Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:8829fc47a53ff89ecaed3fb1065d1a58c80cf5202f9b14f861afd24ffca820c6","observation_id":"4b692380-1411-42ad-a1ed-2a625398ee74","resolution":{"observed_at":"2026-08-11T05:31:07.051576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.032455Z","title":"Classes of Recursively Enumerable Sets and Their Decision Problems","venue":null,"work_id":"363ad7ae-cf63-4bc8-b810-1eaa67a18eb0","year":1953},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.705473Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:dee16714550b4489cae2994ac14b65dd8c42fda62090c56d17f895f731441f0a","observation_id":"aed8d400-f8a6-4d2f-9da4-51dfc71d1256","resolution":{"observed_at":"2026-08-11T05:31:07.037142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.019667Z","title":"Mathematical Discoveries from Program Search with Large Language Models","venue":null,"work_id":"fb445f4e-a05d-47a1-bb54-14a03de85e35","year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.709150Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:03820b901677daef91704ff363b4856c434c2a5041481fbd850a08682f63eb25","observation_id":"24555c14-c00f-4e40-bea1-b7a7a65dd82e","resolution":{"observed_at":"2026-08-11T05:31:07.023915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:07.004094Z","title":"Agent Laboratory: Using LLM Agents as Research Assistants","venue":null,"work_id":"ca306f9e-58c5-4624-bc61-4674189f392c","year":null},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.712742Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:a8a050bee8b33767a5ceb84749060cc372a9c7f98defc4f4094c4d2129cae635","observation_id":"82729eb0-7210-409f-b00c-4915c235f44b","resolution":{"observed_at":"2026-08-11T05:31:07.010463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.970358Z","title":"Ultimate Cognition à la Gödel","venue":null,"work_id":"357753c7-0559-4193-a2b0-ca27baf4c75b","year":2009},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.724853Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:4915b9d9fdfd4893d488f5262bf559441f40eab0910765c39edf083360f8594e","observation_id":"93eec5fd-7ca7-48ed-a0f9-7479716bd5a6","resolution":{"observed_at":"2026-08-11T05:31:06.976105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.952411Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Hu- man Study with 100+ NLP Researchers","venue":null,"work_id":"db44780a-b5fa-4aac-a0ed-66e2441a2dc9","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.728789Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:8d7128901cc28ab9fbd4bf8f556f958b218c33c550a8e9c71b7b66453a5979e5","observation_id":"b3ecce25-ea2f-470e-80f4-4ab4ecbd7341","resolution":{"observed_at":"2026-08-11T05:31:06.958952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.934097Z","title":"Defining and Characterizing Reward Gaming","venue":null,"work_id":"cd13e9a3-b58a-4b50-96ae-a12a61b06558","year":2022},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.738529Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:3496eef589f68ee8b6930516bef86b39cf755112eeb079b9a3216296983aeb09","observation_id":"a0f3035e-3e98-43d7-84f1-38eb1e279e83","resolution":{"observed_at":"2026-08-11T05:31:06.938619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.918608Z","title":"Scaling LLM Test-Time Compute Optimally Can Be More Effec- tive than Scaling Parameters for Reasoning","venue":null,"work_id":"dd09583c-f4ee-452d-88b3-c1dadb992185","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.745894Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:afcb73fbdad1974fc88b2f2e4ff5bad4aa2f14b4f2d43429ecfe22da32c84b93","observation_id":"92bfde03-4666-4856-ac0e-9bc02d92e969","resolution":{"observed_at":"2026-08-11T05:31:06.924035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.906190Z","title":null,"venue":null,"work_id":"97d408c9-ac9b-485a-9d69-e7f8c925dee9","year":2019},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.752407Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:c253cb92b0582a35da8b6ece26160c318d956a1778bb3325156ea149d05ecfda","observation_id":"91f095d7-c654-451b-8739-01a8a8443623","resolution":{"observed_at":"2026-08-11T05:31:06.910001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.893057Z","title":"The Virtual Lab of AI agents designs new SARS-CoV-2 nanobodies","venue":null,"work_id":"16900714-0c4d-40fe-8ee4-7f1b17da257b","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.757416Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:003090d2f6419644a4af8f0ff96c2964dee720725b5d2efbe1057753278bfd5f","observation_id":"a7398345-f1b0-454c-b858-3690a35788fe","resolution":{"observed_at":"2026-08-11T05:31:06.898150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.879483Z","title":"AI Research Agents for Ma- chine Learning: Search, Exploration, and General- ization in MLE-bench","venue":null,"work_id":"e716fd1f-68b0-4dae-9f9d-4099af60d6e4","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.764745Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:805019d471fee21fb2dee6048590a9902bd0e72e0acc997e9d0328e91b3a0ef4","observation_id":"f488f85d-9881-4b70-a391-4c98a13d30d1","resolution":{"observed_at":"2026-08-11T05:31:06.884106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.865110Z","title":"On Computable Numbers, with an Application to the Entscheidungsproblem","venue":null,"work_id":"b2246baa-0663-4ea4-a214-7a76140f701f","year":1936},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.769303Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:4699af43d61e945c0c42e1a5a1c07a500a5038c303f96a98d4424f6feeb51433","observation_id":"37909d0c-1004-46a1-8ff6-0629446e772b","resolution":{"observed_at":"2026-08-11T05:31:06.870103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.851200Z","title":"Large Language Models are not Fair Evaluators","venue":null,"work_id":"ff70b79e-0ebf-4cfb-916c-8b6bd3a727be","year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.777110Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:2750085dc75c313e64416d8c056c8ff38e9030d3a91dbef32825e95b6508a914","observation_id":"bcca53e0-4df5-45aa-b8be-f2bddb4583d8","resolution":{"observed_at":"2026-08-11T05:31:06.855947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.835708Z","title":"RE-Bench: Evaluating Frontier AI R&D Capabilities of Language Model Agents against Human Experts","venue":null,"work_id":"de693efb-8f9a-42cb-b1b9-ddf9feaaf699","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.783973Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:e8aa5f9c106c2c6005b962e51cbffca922271ea7f652781a4c85abd1ae107d4d","observation_id":"7619f226-e7de-45f8-accd-2b2b0483ce93","resolution":{"observed_at":"2026-08-11T05:31:06.841600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-10T03:18:36.275195Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-11T05:31:05.788489Z","title":"The AI Scientist- v2: Workshop-Level Automated Scientific Discov- ery via Agentic Tree Search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.788489Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:5a87b620fb211490131f2963c286c9c4d5ba92dac91736bc5f974c37250bda59","observation_id":"9f82b0d5-4471-486d-a775-bfce9c322e00","resolution":{"observed_at":"2026-08-11T05:31:05.788489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.814343Z","title":"NAS Evaluation Is Frustratingly Hard","venue":null,"work_id":"b00c62b3-e29d-4765-9ebb-a46c2c6da70f","year":2020},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.792859Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:414180bd01212f1bd08c9097de7d64c04f922f862b853de9a768bdbf01c2b71d","observation_id":"892aa5ec-4dbd-4629-ad3c-5b2d2302393d","resolution":{"observed_at":"2026-08-11T05:31:06.818921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01708","last_updated":"2024-12-02T16:55:03Z","snapshot_observed_at":"2026-08-19T12:35:41.035290Z","submitted_at":"2024-12-02T16:55:03Z","title":"Are We There Yet? Revealing the Risks of Utilizing Large Language Models in Scholarly Peer Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01708","snapshot_observed_at":"2026-08-11T05:31:05.797221Z","title":"Are We There Yet? Revealing the Risks of Utilizing Large Language Models in Scholarly Peer Review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.797221Z"},"links":{"cited_paper":"/paper/2412.01708","citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:31af9081bb2e212e24aed0098b867f8c0b706a03fc668d1021ffbead68500ba5","observation_id":"a49e3060-957f-4a10-9ef6-213a7d1157ea","resolution":{"observed_at":"2026-08-11T05:31:05.797221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.801485Z","title":"Dolphin: Moving Towards Closed- loop Auto-research through Thinking, Practice, and Feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.801485Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:3469ed0867603219da76a1e61541ce7320afd5e9f62035da5063ea9b51760685","observation_id":"10e3487c-48c1-42b2-8ae8-14f3fa9a4e41","resolution":{"observed_at":"2026-08-11T05:31:05.801485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.798536Z","title":"Position: LLMs Can’t Jump","venue":null,"work_id":"d72e3bb2-e5bc-4538-9272-17e7995522d7","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.805313Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:1e7b82f7c709d883f3873d37761726c512d7da37909ace5823e4a4e1f0f490a8","observation_id":"548ea2b2-01c4-40e8-8615-b60037ec01e3","resolution":{"observed_at":"2026-08-11T05:31:06.804773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.785189Z","title":"Zalewski.American Fuzzy Lop (AFL)","venue":null,"work_id":"53c56256-5da2-4eee-9499-52362fa17951","year":2013},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.808978Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:46c88d0673defc8a28362679420e65a2dca28724624fffd7a5a68587fc9178a0","observation_id":"ad627df0-b705-4295-ad88-1ee918b62c1c","resolution":{"observed_at":"2026-08-11T05:31:06.789945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3654.37937","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:05.985444Z","title":"LLAMA- FUZZ: Large Language Model Enhanced Greybox Fuzzing","venue":null,"work_id":"2921701a-cff4-40df-8843-3ca155beb307","year":2026},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.812639Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:9ed874d4bf8a3f0a9383f9d6eaf5f3d9bf784aa41ded6ce2755f498fe9464612","observation_id":"885c986b-eac3-4395-b451-94c833bb0e6d","resolution":{"observed_at":"2026-08-11T05:31:06.005863Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.773600Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":null,"work_id":"c587cb31-d4df-44d3-a39e-3cc19d518784","year":2023},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.816414Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:4a8abc98b9bb597f0b157379cce2315f4750952e6f129507acde3048465566e4","observation_id":"9ce60152-0e53-42d5-9555-dbdde4bbee69","resolution":{"observed_at":"2026-08-11T05:31:06.777396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.759582Z","title":"Neural Architecture Search with Reinforcement Learning","venue":null,"work_id":"c09a4972-e2d0-4dcd-bc56-308a1d0cded3","year":2017},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.820448Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:06b49e025bd09887e5b1003a8ae5bb630dbb8beefb9803c358504901f72ccf7a","observation_id":"24e4d74f-04dd-4c9a-9b19-1fe4016cdedb","resolution":{"observed_at":"2026-08-11T05:31:06.763454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:31:06.987827Z","title":"5977–6043.DOI: 10","venue":null,"work_id":"c4da919c-49c3-4cf2-9be2-455636892211","year":2025},"citing_paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T05:31:05.720662Z"},"links":{"citing_paper":"/paper/2608.09855"},"observation_digest":"sha256:c4666166ab1ba8aebb684aa5cbdd97b853c20fe1ab9dc0ad3969746fdff68819","observation_id":"5bbfe757-0dc0-45c7-84de-a895aec551b4","resolution":{"observed_at":"2026-08-11T05:31:06.993181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.09855","last_updated":"2026-08-10T17:13:02Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T18:07:24.924495Z","submitted_at":"2026-08-10T17:13:02Z","title":"Agentic Auto-Research is Fuzz Testing"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":37},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2608.09855."}