{"as_of":"2026-08-09T03:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:20a9afbf317fb5aaeb7902ae01905b77fe196e755c5058727e64320465456460","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:49:31.644941Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03569/citation-record","integrity":"/paper/2608.03569/integrity","json":"/paper/2608.03569/citation-record.json","paper":"/paper/2608.03569"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.05080","last_updated":"2025-03-31T14:39:44Z","snapshot_observed_at":"2026-07-06T19:29:05.492290Z","submitted_at":"2024-10-07T14:33:50Z","title":"ScienceAgentBench: Toward Rigorous Assessment of Language Agents for Data-Driven Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05080","snapshot_observed_at":"2026-08-05T16:49:30.068458Z","title":"Sci- enceagentbench: Toward rigorous assessment of language agents for data-driven scientific discovery.arXiv preprint arXiv:2410.05080,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:30.068458Z"},"links":{"cited_paper":"/paper/2410.05080","citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:28b9ea4b9832f07cf025e3a9b6fef6881f76637dd83d73142a7e9bf68be89648","observation_id":"a3ab6b94-0a2d-4abd-b2ed-7c5c83063fe8","resolution":{"observed_at":"2026-08-05T16:49:30.068458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19839","last_updated":"2025-02-28T12:35:34Z","snapshot_observed_at":"2026-07-06T19:24:12.811792Z","submitted_at":"2024-09-30T00:41:51Z","title":"ForecastBench: A Dynamic Benchmark of AI Forecasting Capabilities","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19839","snapshot_observed_at":"2026-08-05T16:49:30.512877Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:30.512877Z"},"links":{"cited_paper":"/paper/2409.19839","citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:222455b5d6ea3558b63ce8ad3998563d2ee8b048cf8fafcff422befcef75b2e9","observation_id":"5631c270-2358-4f58-a2fd-2ac6db1592b6","resolution":{"observed_at":"2026-08-05T16:49:30.512877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-05T16:49:30.717054Z","title":"T., Foerster, J., Clune, J., and Ha, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:30.717054Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:af6e5706ace0ca6efa859c11baf9d53e7efecf94bf312c4c5c0cc9234eeafc03","observation_id":"c379a996-6125-4efe-94e8-809ede86af11","resolution":{"observed_at":"2026-08-05T16:49:30.717054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01725","last_updated":"2024-07-01T18:58:22Z","snapshot_observed_at":"2026-08-08T10:30:21.222993Z","submitted_at":"2024-07-01T18:58:22Z","title":"DiscoveryBench: Towards Data-Driven Discovery with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01725","snapshot_observed_at":"2026-08-05T16:49:30.826606Z","title":"P., Surana, H., Agarwal, D., Mishra, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:30.826606Z"},"links":{"cited_paper":"/paper/2407.01725","citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:e78a79ffc313d1b366e05b1ea074e7074e6f110d01b58f5d9978ef36edd6188f","observation_id":"dd6f15d4-ddf1-4083-a44a-ce16881e4355","resolution":{"observed_at":"2026-08-05T16:49:30.826606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.02824","last_updated":"2025-11-05T18:26:43Z","snapshot_observed_at":"2026-07-06T22:34:53.346702Z","submitted_at":"2025-11-04T18:50:52Z","title":"Kosmos: An AI Scientist for Autonomous Discovery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.02824","snapshot_observed_at":"2026-08-05T16:49:30.935054Z","title":"C., Barabasi, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:30.935054Z"},"links":{"cited_paper":"/paper/2511.02824","citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:e1754d2780dd78060541bfba80829c4b57f3a638ebcdb5118f17386e89e8fc78","observation_id":"59cfb5db-7108-4576-9e6c-3200761ce8be","resolution":{"observed_at":"2026-08-05T16:49:30.935054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04109","last_updated":"2024-09-06T08:25:03Z","snapshot_observed_at":"2026-08-08T00:38:42.440129Z","submitted_at":"2024-09-06T08:25:03Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04109","snapshot_observed_at":"2026-08-05T16:49:31.065187Z","title":"Can llms generate novel research ideas? a large-scale human study with 100+ nlp researchers.arXiv preprint arXiv:2409.04109,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:31.065187Z"},"links":{"cited_paper":"/paper/2409.04109","citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:93b8ef396c708e0b0ed75c837228b30e86ad1b1f3fb69dec2de3e1bb92d3a3f3","observation_id":"3747fce7-1b60-45ae-a04d-011d2080ab68","resolution":{"observed_at":"2026-08-05T16:49:31.065187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:49:32.801168Z","title":"The OpenAI models GPT-5.2 (August 2025 knowledge cutoff) and o3 (June 2024 knowledge cutoff) were accessed via the OpenAI API","venue":null,"work_id":"c5c7a61a-31ef-4da1-b1d0-129aa2ee1715","year":2025},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:31.376412Z"},"links":{"citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:923a76d5f5acca2b931c69661a112c58637fe7be2868a6aaa2974aeb4e939965","observation_id":"169d8e35-c741-460f-99cd-e9a6d8b2d28e","resolution":{"observed_at":"2026-08-05T16:49:32.933185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:49:32.459380Z","title":"F1 generated ideas and real innovations were embedded with OpenAI’s text-embedding-3-smallmodel","venue":null,"work_id":"8146d072-04c3-4675-bca2-4d85e07f2c3d","year":2026},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:31.537167Z"},"links":{"citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:93134651c1ad64586377a9cdf070e477f2cabb2bc7c44439eefdf42347204b86","observation_id":"59afc6b7-3d9e-4574-86f4-85f86783ef5c","resolution":{"observed_at":"2026-08-05T16:49:32.609363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:49:32.217489Z","title":"The Top 15 by Day 2 standings and four featured archetype-diverse builds were collected from official PT Lorwyn Eclipsed coverage (30 January – 1 February 2026)","venue":null,"work_id":"90320f13-fe41-4ebd-bc73-fc5a0ca3a05d","year":2026},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:31.644941Z"},"links":{"citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:55ffb18c4f80119496294f70a41870aa6c3631570499437a9645bbe0339d9dda","observation_id":"f22159b8-34bc-4bc8-901a-fe799a0b686e","resolution":{"observed_at":"2026-08-05T16:49:32.318667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01848","last_updated":"2025-04-07T12:15:49Z","snapshot_observed_at":"2026-07-06T21:03:06.857885Z","submitted_at":"2025-04-02T15:55:24Z","title":"PaperBench: Evaluating AI's Ability to Replicate AI Research","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01848","snapshot_observed_at":"2026-08-05T16:49:31.209853Z","title":"S., Maksin, L., Dias, R., Mays, E., Kinsella, B., Thompson, W., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:31.209853Z"},"links":{"cited_paper":"/paper/2504.01848","citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:d5a48030012c6c73acbdb87326a4356531256410416c8038e1137cc29ae30d42","observation_id":"2ac05b38-ed7a-43cd-b0b9-8d02f0a39d79","resolution":{"observed_at":"2026-08-05T16:49:31.209853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:49:30.630149Z","title":"Hypobench: Towards systematic and principled benchmarking for hy- pothesis generation.arXiv preprint arXiv:2504.11524,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:30.630149Z"},"links":{"citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:ca21c215a7b2b1bb6d81dac6194cf7d8fde09303063e39515f725da65159cfc2","observation_id":"cf814ed1-801c-44a9-bdb6-9b7d35e4d64e","resolution":{"observed_at":"2026-08-05T16:49:30.630149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:49:30.224091Z","title":"The need for verification in ai-driven scientific discov- ery.arXiv preprint arXiv:2509.01398,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:30.224091Z"},"links":{"citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:defc2a020e801e4fbbcbcfeddc5fbe297192f4889654367bd058395de55d1556","observation_id":"d120eba0-5157-401d-91c6-209f271b002e","resolution":{"observed_at":"2026-08-05T16:49:30.224091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-05T16:49:30.364773Z","title":"com/DGoettlich/history-llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T16:49:30.364773Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2608.03569"},"observation_digest":"sha256:1d01ebcb8b259e1b3b0a83072efd7047b0bca3f440cf0c284eb12a5d00bcf558","observation_id":"59dcc89c-8b05-4fa2-abce-7fa3c868ef2e","resolution":{"observed_at":"2026-08-05T16:49:30.364773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03569","last_updated":"2026-08-04T12:30:13Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T23:12:06.841357Z","submitted_at":"2026-08-04T12:30:13Z","title":"Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2608.03569."}