{"as_of":"2026-08-08T03:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01e60954f96ccce6ca52b975731b58cfa36d77e4b2b58ea28e29c7f0d2ca5885","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:05:56.920833Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:46:32.625500Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00794","snapshot_observed_at":"2026-08-06T22:46:32.625500Z","title":"Predicting Empirical AI Research Outcomes with Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20803","last_updated":"2025-06-25T19:47:23Z","snapshot_observed_at":"2026-08-08T00:00:29.854162Z","submitted_at":"2025-06-25T19:47:23Z","title":"The Ideation-Execution Gap: Execution Outcomes of LLM-Generated versus Human Research Ideas","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T22:46:32.625500Z"},"links":{"cited_paper":"/paper/2506.00794","citing_paper":"/paper/2506.20803"},"observation_digest":"sha256:5a3670756ef75df9b05720952b856c9dbb5e04cf34d00bbe641d62e5db77378b","observation_id":"75729d29-f9d4-45d6-9258-680d865673ea","resolution":{"observed_at":"2026-08-06T22:46:32.625500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00794","snapshot_observed_at":"2026-08-06T14:22:31.403988Z","title":"Predicting empirical ai research outcomes with language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19477","last_updated":"2025-07-25T17:59:13Z","snapshot_observed_at":"2026-08-07T21:58:03.201541Z","submitted_at":"2025-07-25T17:59:13Z","title":"Advancing Event Forecasting through Massive Training of Large Language Models: Challenges, Solutions, and Broader Impacts","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T14:22:31.403988Z"},"links":{"cited_paper":"/paper/2506.00794","citing_paper":"/paper/2507.19477"},"observation_digest":"sha256:493b473bb3b4e281c4de66f35b8348058a6c1368f8e926f1542520e3d337b10f","observation_id":"ad6885f1-249d-4223-b8d8-ee4b259d3fc8","resolution":{"observed_at":"2026-08-06T14:22:31.403988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"cited_work":{"arxiv_id":"2506.00794","doi":"10.48550/arxiv.2506.00794","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00794","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ArXiv.org","work_id":"045c057e-5a99-45d0-9915-8d6413c5c295","year":2025},"citing_paper":{"arxiv_id":"2604.23593","last_updated":"2026-04-26T08:03:32Z","snapshot_observed_at":"2026-08-01T01:43:18.294936Z","submitted_at":"2026-04-26T08:03:32Z","title":"When AI reviews science: Can we trust the referee?","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-05-08T06:19:54.727724Z"},"links":{"cited_paper":"/paper/2506.00794","citing_paper":"/paper/2604.23593"},"observation_digest":"sha256:d948ccf68ce35f5f47bb6388ea5bc9d97305825be44b0542255471f0b85733cf","observation_id":"6f01eadf-26ff-4fc2-a488-672666bbc266","resolution":{"observed_at":"2026-05-08T23:19:30.523123Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00794/citation-record","integrity":"/paper/2506.00794/integrity","json":"/paper/2506.00794/citation-record.json","paper":"/paper/2506.00794"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.06941","last_updated":"2024-05-17T06:35:19Z","snapshot_observed_at":"2026-07-06T17:00:11.930733Z","submitted_at":"2023-12-12T02:28:12Z","title":"Humans vs Large Language Models: Judgmental Forecasting in an Era of Advanced AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06941","snapshot_observed_at":"2026-08-07T12:05:55.463704Z","title":"Humans vs large language models: Judgmental forecasting in an era of advanced ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.463704Z"},"links":{"cited_paper":"/paper/2312.06941","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:db90ae53b9c0a891f01585df44a9aab41efdc240f78433541b8f2aba4ee144ea","observation_id":"eeedf0a2-6028-41b2-88b6-a18fc3c612c4","resolution":{"observed_at":"2026-08-07T12:05:55.463704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01788","last_updated":"2025-03-21T14:49:10Z","snapshot_observed_at":"2026-08-08T03:04:39.404837Z","submitted_at":"2024-02-02T02:41:28Z","title":"LitLLM: A Toolkit for Scientific Literature Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01788","snapshot_observed_at":"2026-08-07T12:05:55.548904Z","title":"Laradji, Laurent Charlin, and Christopher Pal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.548904Z"},"links":{"cited_paper":"/paper/2402.01788","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:a782bceac309e32e6c4b57a482bca6810442db583dd72e8147c712a97f284be1","observation_id":"5afbfc62-d585-46c0-b450-f74f715fbc02","resolution":{"observed_at":"2026-08-07T12:05:55.548904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:55.630510Z","title":"Alpacafarm: A simulation framework for methods that learn from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.630510Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:a6d7cd6cdbbb07eb1ec344d84ce8d4b1b7ef8d8b8805b081ba67c7dfc4a605ed","observation_id":"fc8f2d72-b221-469b-ae01-f7db11fb3458","resolution":{"observed_at":"2026-08-07T12:05:55.630510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-07T12:05:55.709041Z","title":"Towards an ai co-scientist","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.709041Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:84b76c4d5dc902bd3f5c1543b404223261ae318f91886ce9f7bd15aa9385a541","observation_id":"1aa981e8-d446-4ee9-b2e8-61bed3beb569","resolution":{"observed_at":"2026-08-07T12:05:55.709041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18563","last_updated":"2024-02-28T18:54:18Z","snapshot_observed_at":"2026-08-05T11:22:12.976973Z","submitted_at":"2024-02-28T18:54:18Z","title":"Approaching Human-Level Forecasting with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18563","snapshot_observed_at":"2026-08-07T12:05:55.787770Z","title":"Approaching human-level forecasting with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.787770Z"},"links":{"cited_paper":"/paper/2402.18563","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:91de88a87812bc428983d94dc27ccd23fa6ae4b5b924bb20d3eedff6c61e72bd","observation_id":"49b6c088-00af-4006-bb02-7765bf1c0c7a","resolution":{"observed_at":"2026-08-07T12:05:55.787770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03302","last_updated":"2024-04-14T21:02:16Z","snapshot_observed_at":"2026-08-03T01:30:37.931398Z","submitted_at":"2023-10-05T04:06:12Z","title":"MLAgentBench: Evaluating Language Agents on Machine Learning Experimentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03302","snapshot_observed_at":"2026-08-07T12:05:55.906410Z","title":"Mlagentbench: Evaluating language agents on machine learning experimentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.906410Z"},"links":{"cited_paper":"/paper/2310.03302","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:9cc98126511ab6fc687a58b596acbc6426b22987461c31b4f6b15d97641a8ee1","observation_id":"cdc97199-e562-4ef9-abd7-04dff8b60230","resolution":{"observed_at":"2026-08-07T12:05:55.906410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19839","last_updated":"2025-02-28T12:35:34Z","snapshot_observed_at":"2026-07-06T19:24:12.811792Z","submitted_at":"2024-09-30T00:41:51Z","title":"ForecastBench: A Dynamic Benchmark of AI Forecasting Capabilities","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19839","snapshot_observed_at":"2026-08-07T12:05:55.960132Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.960132Z"},"links":{"cited_paper":"/paper/2409.19839","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:f86236b1fc76a243f9b793ba1bf9746203379f6976781126c6b971d036094204","observation_id":"0cd05966-ff5e-464d-9e8a-51b3cec2e9f0","resolution":{"observed_at":"2026-08-07T12:05:55.960132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.811737Z","title":"Can large language models provide useful feedback on research papers? a large-scale empirical analysis","venue":null,"work_id":"f3321a78-e94f-48a8-b33c-7ce33f23433f","year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.082833Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:c9be5906f6e44001875f76020726c31ca27c54634841028069b4d2bd0c7b8594","observation_id":"4296a1ca-9f15-4fae-a8ed-b57e1d4e8ce4","resolution":{"observed_at":"2026-08-07T12:05:57.932804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-07T12:05:56.133782Z","title":"The ai scien- tist: Towards fully automated open-ended scientific discovery.arXiv preprint arXiv:2408.06292, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.133782Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:ec5147e0517561436ed3f3e2159f70ec61f923162e0b283d087116ea38a3eeec","observation_id":"2c1e4a31-56d0-4603-a789-7efdf5865715","resolution":{"observed_at":"2026-08-07T12:05:56.133782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.645649Z","title":"Large language models surpass human experts in predicting neuroscience results","venue":null,"work_id":"ce40b63e-3c64-4369-af97-2b96959aba9a","year":2025},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.207802Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:9c0cca30559ef093488eec94f8a95dd24a938b6b92cbe7479ad679866bcca4d1","observation_id":"38538177-e28b-497e-a42a-d26786893a42","resolution":{"observed_at":"2026-08-07T12:05:57.711264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.483154Z","title":"Neurips 2021 summary, 2021","venue":null,"work_id":"f9cf67ff-5470-4d88-9baf-74802e5fd26e","year":2021},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.278474Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:bffa25595ab914e8cf7a5f4a98c594381f235055f7ca5beb3bc1a0e6fe45b2ab","observation_id":"ffb9baa2-5f72-488d-a125-056f2bf2e482","resolution":{"observed_at":"2026-08-07T12:05:57.544494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03495","last_updated":"2023-10-19T04:37:25Z","snapshot_observed_at":"2026-08-06T03:31:54.947656Z","submitted_at":"2023-05-04T15:15:22Z","title":"Automatic Prompt Optimization with \"Gradient Descent\" and Beam Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03495","snapshot_observed_at":"2026-08-07T12:05:56.352320Z","title":"gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.352320Z"},"links":{"cited_paper":"/paper/2305.03495","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:44b58953612c9be9914e1b45e7ee994f105fc115451a2df52937b2ced144f7ed","observation_id":"0dde4865-f67f-48c4-b329-bb5f47e9ba75","resolution":{"observed_at":"2026-08-07T12:05:56.352320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13014","last_updated":"2023-10-17T17:58:17Z","snapshot_observed_at":"2026-07-06T16:35:48.413898Z","submitted_at":"2023-10-17T17:58:17Z","title":"Large Language Model Prediction Capabilities: Evidence from a Real-World Forecasting Tournament","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13014","snapshot_observed_at":"2026-08-07T12:05:56.438248Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.438248Z"},"links":{"cited_paper":"/paper/2310.13014","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:5d8a3bf22a79c78d891744afb03a4cd2094a0e6d461f2d3e6d66cf6d8ccec705","observation_id":"eb511723-d2e8-495a-bfb2-835ceb4dc392","resolution":{"observed_at":"2026-08-07T12:05:56.438248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04109","last_updated":"2024-09-06T08:25:03Z","snapshot_observed_at":"2026-08-08T00:38:42.440129Z","submitted_at":"2024-09-06T08:25:03Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04109","snapshot_observed_at":"2026-08-07T12:05:56.506033Z","title":"Can llms generate novel research ideas? a large-scale human study with 100+ nlp researchers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.506033Z"},"links":{"cited_paper":"/paper/2409.04109","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:c9e37f3e087e552a23be54967ddc645f913480f3140405638776db78910f3162","observation_id":"4095f34d-131c-4688-80e5-493e69d74eb7","resolution":{"observed_at":"2026-08-07T12:05:56.506033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:56.611944Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.611944Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:25f4a2ed59e7bb37e219239f27a0b938bbaad9621646de70d3fbc47d8514cc00","observation_id":"45f0081e-14e6-41e4-a1a7-3671dc72148b","resolution":{"observed_at":"2026-08-07T12:05:56.611944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-01T14:58:15.255937Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-07T12:05:56.687259Z","title":"The ai scientist-v2: Workshop-level automated scientific discovery via agentic tree search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.687259Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:c4cd08c75cad9cf832706d73702de6434502c768bb9a53794615629f5265ba21","observation_id":"7ad5eaaa-d310-4f25-8756-19b310dafb9b","resolution":{"observed_at":"2026-08-07T12:05:56.687259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:56.756008Z","title":"Star: Self-taught reasoner bootstrapping reasoning with reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.756008Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:9b8068c1d935f38d50b34281c5a053a4a99233a1d4765d2fe37849b4c12b9620","observation_id":"bcad7cf2-68d6-4dcf-9079-bf410cf2d921","resolution":{"observed_at":"2026-08-07T12:05:56.756008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.275220Z","title":"Goal driven discovery of distributional differences via language descriptions","venue":null,"work_id":"2e9e6d24-8eec-4017-9e7f-e5aa9bef8a20","year":2023},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.806527Z"},"links":{"citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:5e74b55ee44d7d0ddeb456ac24adbe3c635fbc647f8b8a0f7bef1fac222791a6","observation_id":"25018129-528f-42b4-a652-008c26bb6588","resolution":{"observed_at":"2026-08-07T12:05:57.331730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.15474","last_updated":"2022-10-09T23:32:19Z","snapshot_observed_at":"2026-07-06T13:26:33.250328Z","submitted_at":"2022-06-30T17:59:14Z","title":"Forecasting Future World Events with Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.15474","snapshot_observed_at":"2026-08-07T12:05:56.920833Z","title":"Forecasting future world events with neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.920833Z"},"links":{"cited_paper":"/paper/2206.15474","citing_paper":"/paper/2506.00794"},"observation_digest":"sha256:eb29e11f78570ca42329802bc9e62c3fb81bec23999781671e3b5e6a252cf402","observation_id":"8a627cc6-e1e6-4218-9782-d04bf14298e5","resolution":{"observed_at":"2026-08-07T12:05:56.920833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00794","last_updated":"2025-06-01T02:46:31Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T11:55:29.059375Z","submitted_at":"2025-06-01T02:46:31Z","title":"Predicting Empirical AI Research Outcomes with Language Models"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 3 inbound Pith citation observations for arXiv:2506.00794."}