{"as_of":"2026-08-06T02:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6600849cfc0fc74399526a9aef2171939d69286d312d7563e7e6cb210c237179","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:31:46.418313Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.22681/citation-record","integrity":"/paper/2605.22681/integrity","json":"/paper/2605.22681/citation-record.json","paper":"/paper/2605.22681"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:41.566339Z","title":"Atypical combinations and scientific impact.Science, 342(6157):468–472, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:41.566339Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:d646b85746084fbe680748e3d1d6a5d1d58df0119d30c5c722cf94babe83c8a9","observation_id":"c2afdb52-9944-4669-a817-3e1ecc0eb134","resolution":{"observed_at":"2026-08-02T13:31:41.566339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:41.699090Z","title":"The structure of scientific revolutions.The Philosophical Review, 73(3):383– 394, 1964","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:41.699090Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:8eb0e99f4dfe89cb60924085fd701c3d341536fd36d5ee0465e0ce6d52b47f43","observation_id":"1a41bd7b-6cbf-406b-a2d1-6f5ca3aa396a","resolution":{"observed_at":"2026-08-02T13:31:41.699090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:41.820785Z","title":"Moore’s law.Electronics Magazine, 38(8):114, 1965","venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:41.820785Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:4055a5ccb7e499902ffa8a33165e3fb532f202ca7eced3bfc87696e81c3860ba","observation_id":"00968d32-6315-4f3d-9650-d55f1efc94c7","resolution":{"observed_at":"2026-08-02T13:31:41.820785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-02T13:31:41.987775Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:41.987775Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:fba91c069517c3c8d4974f8469d55fc4bbecbd04da09064e7ee17231327963ab","observation_id":"ea62e76a-9090-4db2-8d19-79aacf048eec","resolution":{"observed_at":"2026-08-02T13:31:41.987775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:42.159297Z","title":"Science of science","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:42.159297Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:c592f6ece20b50a8838110b208a61347d2f67ce968756333b3aba1f200fa1057","observation_id":"cc392369-17fb-4833-ab68-352c62417f18","resolution":{"observed_at":"2026-08-02T13:31:42.159297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:42.317399Z","title":"Papers and patents are becoming less disruptive over time.Nature, 613(7942):138–144, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:42.317399Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:318977964ec16798c9648cff7da6621b2780862bd2e4dd4691985300bb7b846a","observation_id":"18958864-e9e3-4064-a9ed-8a1c6fa8d241","resolution":{"observed_at":"2026-08-02T13:31:42.317399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:42.412972Z","title":"The development of technology foresight: A review.Technological forecasting and social change, 77(9):1448–1456, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:42.412972Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:1fc1c79bfd16ed183bdfb5025fadab3a63f4b82ce72a1ae0e8198998360c6e5f","observation_id":"9dec2dd7-fac2-4db2-bdf4-1334dfeed7e5","resolution":{"observed_at":"2026-08-02T13:31:42.412972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:42.470690Z","title":"Highly accurate protein structure prediction with alphafold.Nature, 596(7873):583–589, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:42.470690Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:825c98ca497b6f6ad99ca8de47d03f5b25649494c58cf1237aa3961b673acfd2","observation_id":"bde476e0-b3e5-45d9-8d08-2edca559de74","resolution":{"observed_at":"2026-08-02T13:31:42.470690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:42.636730Z","title":"Accurate structure prediction of biomolecular interactions with alphafold 3.Nature, 630(8016):493–500, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:42.636730Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:1f4d9e448e86d65f24c66b01eb3eba2c3131416c25c4f757270080c84c8724a8","observation_id":"ed6dc746-38aa-4c18-9eb0-a190684d91e7","resolution":{"observed_at":"2026-08-02T13:31:42.636730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-02T13:31:42.812903Z","title":"Alphaevolve: A coding agent for scientific and algorithmic discovery.arXiv preprint arXiv:2506.13131, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:42.812903Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:e29d36a951ee4272ff7f54577e60af872039be584800536986264bc16def350c","observation_id":"095f2dee-d41c-47e7-9bf2-9c7f63d53726","resolution":{"observed_at":"2026-08-02T13:31:42.812903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:42.952808Z","title":"Scaling deep learning for materials discovery.Nature, 624(7990):80–85, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:42.952808Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:8fc9d528113d1db5380180c336068278c4461175874f92fb2afbf1feed84ee1b","observation_id":"f94402de-2162-40b8-9c6c-c20a22ba6f99","resolution":{"observed_at":"2026-08-02T13:31:42.952808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:43.094588Z","title":"The virtual lab of ai agents designs new sars-cov-2 nanobodies.Nature, 646(8085):716–723, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:43.094588Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:c92a9dcbec76bcb21105a292fbdc569e2c4bae144a12d93dc6d0f4cb736d37a7","observation_id":"ab97b7ae-6a3e-4a74-bea7-899e5ecd7122","resolution":{"observed_at":"2026-08-02T13:31:43.094588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:43.329463Z","title":"Accelerating scientific discovery with co-scientist.Nature, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:43.329463Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:52fdcd1c54b3445c673aa8de14c45e14b9d097169461570cd2c613af44ae0b87","observation_id":"3b7032b7-19d6-4a03-8f4c-1b33edafb152","resolution":{"observed_at":"2026-08-02T13:31:43.329463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:43.463940Z","title":"Szostkiewicz, Dmytro Shved, Gavin J","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:43.463940Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:42b2101cf50a20cf424ab121fc502219b933d9da71c13797c8eea19efd73dfbc","observation_id":"f4cd2844-443d-4820-86d1-0b8aa975ffb0","resolution":{"observed_at":"2026-08-02T13:31:43.463940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:43.635607Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:43.635607Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:d733f168653eafb79c3ab4466904ff658e6d1e5b2ce46d3690d59ef4bebc2dc5","observation_id":"ef6f7a82-abbf-4227-b105-6360e7eb94ba","resolution":{"observed_at":"2026-08-02T13:31:43.635607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:43.784847Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:43.784847Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:502cd32c8423ff0128afed56eb25a16221ba4ae08e3446d3e87f96f442b3b133","observation_id":"f62d561c-d3d8-4b4f-ba17-9fe698e95988","resolution":{"observed_at":"2026-08-02T13:31:43.784847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:43.950536Z","title":"Astabench: Rigorous benchmarking of ai agents with a scientific research suite","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:43.950536Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:a52511d398339ba91be951fe3b019c8a2842cf357e2604be2f5f34b0f5563506","observation_id":"efa7af0a-1728-4eb4-87da-6aaea5e0f159","resolution":{"observed_at":"2026-08-02T13:31:43.950536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:44.090634Z","title":"A benchmark of expert-level academic questions to assess AI capabilities.Nature, 649:1139–1146, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.090634Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:543b4d356dee7b853aea02a0aea6413d3976427c4bfc8a3af93cbc7489df97b0","observation_id":"e072fbb6-10a0-4c07-9d2b-62a74a382000","resolution":{"observed_at":"2026-08-02T13:31:44.090634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.20459","last_updated":"2026-07-02T01:11:49Z","snapshot_observed_at":"2026-08-05T17:42:51.152778Z","submitted_at":"2026-02-24T01:37:53Z","title":"PreScience: A Dataset and Benchmark for Scientific Forecasting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.20459","snapshot_observed_at":"2026-08-02T13:31:44.240684Z","title":"Prescience: A benchmark for forecasting scientific contributions.arXiv preprint arXiv:2602.20459, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.240684Z"},"links":{"cited_paper":"/paper/2602.20459","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:f38414518badcd05791c94505a1cf1ce99b04219f66d395a2d9369c9926c050b","observation_id":"081fb538-cbd9-443c-ae54-cd5e6f21b1ea","resolution":{"observed_at":"2026-08-02T13:31:44.240684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:44.388649Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.388649Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:6f41245ee7db4cd26b00e72a9e35e8e68d8072133fb43f8e26e4d0cb518baa6c","observation_id":"1fab1dbc-fbf1-43ad-84a9-65b0694dce7f","resolution":{"observed_at":"2026-08-02T13:31:44.388649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:44.484684Z","title":"Forecastbench: A dynamic benchmark of AI forecasting capabilities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.484684Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:a6da13165fc3a05b889e95f5b052784f517f590b97f9057c29370b92b7898d44","observation_id":"dec19423-0ffd-43f5-86b4-38a344bfac0c","resolution":{"observed_at":"2026-08-02T13:31:44.484684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11987","last_updated":"2025-09-05T09:15:55Z","snapshot_observed_at":"2026-08-05T19:39:12.827378Z","submitted_at":"2025-08-16T08:54:08Z","title":"FutureX: An Advanced Live Benchmark for LLM Agents in Future Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.11987","snapshot_observed_at":"2026-08-02T13:31:44.585483Z","title":"Futurex: An advanced live benchmark for llm agents in future prediction.arXiv preprint arXiv:2508.11987, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.585483Z"},"links":{"cited_paper":"/paper/2508.11987","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:5763e2988436c6cd00c490678bb1e00c7f6c0dcaeb2ad6f1aec43d703ac7f79e","observation_id":"072fb71f-1a39-485a-b248-f830b7ee8264","resolution":{"observed_at":"2026-08-02T13:31:44.585483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:44.671225Z","title":"Introducing FOReCAst: The future outcome reasoning and confidence assessment benchmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.671225Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:aa14d195fa317fcfeb9d57d4a38d8a438241a5381f0c4888f0352fe80e75dadb","observation_id":"3039f5e2-8d66-45c0-927b-978a805ccb80","resolution":{"observed_at":"2026-08-02T13:31:44.671225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:44.835358Z","title":"Prophet: An inferable future forecasting benchmark with causal intervened likelihood estimation.arXiv preprint arXiv:2504.01509, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.835358Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:b3ed6bcdfa0840dd1791de2ef183f03a0fae4cd83ec2fe7b63a6d2cd36db4505","observation_id":"0f912880-7754-4879-89c9-d64bc62a64eb","resolution":{"observed_at":"2026-08-02T13:31:44.835358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-08-02T13:31:44.953243Z","title":"Researchbench: Benchmarking llms in scientific discovery via inspiration-based task decomposition.arXiv preprint arXiv:2503.21248, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:44.953243Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:33440cccde56568f5ad15f77146aa4fe988a64ee32a36d414cd741630a06e40c","observation_id":"11219177-21d5-4887-b9c5-be5225a21935","resolution":{"observed_at":"2026-08-02T13:31:44.953243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:45.053649Z","title":"Matter-of-fact: A benchmark for verifying the feasibility of literature-supported claims in materials science","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.053649Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:f15197dad1720ac5be144f358c4e9656398fab3e2af3c894a38aa2f7a2f518de","observation_id":"616e662e-17b1-4c1d-a7c2-a518a0f46f41","resolution":{"observed_at":"2026-08-02T13:31:45.053649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:45.160256Z","title":"Solving 19 inequality proofs with large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.160256Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:262147732715de637c0da32ad293b4328b74b99866334511df4375f27cae205e","observation_id":"64e40c8f-e263-498a-bc03-0f79cf7f2d28","resolution":{"observed_at":"2026-08-02T13:31:45.160256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:45.173601Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.173601Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:961c9f26484d077d193355b79f3c214bce6ca9ddace71962cb827dfc76c87357","observation_id":"f0216190-d32a-4dab-9e75-cf10aa1dfc35","resolution":{"observed_at":"2026-08-02T13:31:45.173601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:45.242784Z","title":"Walk the talk? measuring the faithfulness of large language model explanations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.242784Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:02a9f45b9c253310240570c698c0006b5d35815432ca7083b10fb54efa777989","observation_id":"f5976fbc-8f7b-466e-bc3a-367aeaacd071","resolution":{"observed_at":"2026-08-02T13:31:45.242784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:45.387183Z","title":"Introducing GPT-5.4","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.387183Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:74be03e79e6d9ad23e42e6aa6e820cd8b3da942bdc34f2c2e1a4cb77e86aeb20","observation_id":"76666362-a066-4bee-acf5-c0df60f06f3d","resolution":{"observed_at":"2026-08-02T13:31:45.387183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-02T13:31:45.498815Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.498815Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:940b4dbd1c861be1113a9cf3d7d98d2e0a9bf26e33dc14a6010178b67bed8d40","observation_id":"8d1247c3-05a1-420e-a578-7d84746f93d3","resolution":{"observed_at":"2026-08-02T13:31:45.498815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:45.614816Z","title":"Introducing claude sonnet 4.5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.614816Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:df761ecce5fa8291f7d70d2c0d57d076f3cd56314504df44ebc91cb0db155171","observation_id":"8c1349ed-02d6-45f8-a235-373fdd589c56","resolution":{"observed_at":"2026-08-02T13:31:45.614816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T13:31:45.715415Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.715415Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:f3ad013dc80e4ab5bd1d03803a37c195081a597a94804e25f260a94af5ef0eb8","observation_id":"13517d32-7d41-4833-a008-476464870083","resolution":{"observed_at":"2026-08-02T13:31:45.715415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-02T13:31:45.787642Z","title":"gpt-oss-120b & gpt-oss-20b model card.arXiv preprint arXiv:2508.10925, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.787642Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:380b5a0f70db1db370ca446273346808596b533b00add60f337a08f4dbb453c6","observation_id":"e4d1cf65-67cb-4411-86b5-5c23159e7f69","resolution":{"observed_at":"2026-08-02T13:31:45.787642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:45.938420Z","title":"Deepseek-r1 incentivizes reasoning in llms through reinforcement learning.Nature, 645(8081):633–638, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:45.938420Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:7ffe127634b65fb914f108024b60dbb65887a3be5e88c1cf4b7f8a2b7a3dd512","observation_id":"b83d5104-26c5-4cfa-9f27-09da89ff6505","resolution":{"observed_at":"2026-08-02T13:31:45.938420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.087014Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.087014Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:1c50b758e8624cee4bdae3fec6f38ae12f1510e261e1e5b6a8583ac4ed48eb13","observation_id":"9a7fdcec-a510-4ab2-865c-890886a12ea4","resolution":{"observed_at":"2026-08-02T13:31:46.087014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.197311Z","title":"Protein data bank.Nature New Biol, 233(223):10–1038, 1971","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.197311Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:3fce98f995d76a87287efe79bf58f5cf3190a5672365047a03cfc86d7dd78f72","observation_id":"cff76311-d7f5-4ef3-bc60-56d207b541b0","resolution":{"observed_at":"2026-08-02T13:31:46.197311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.310579Z","title":"Exploring the use of ai authors and reviewers at agents4science.Nature Biotechnology, pages 1–4, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.310579Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:843e7fde3576663c4e42d54bdc30837c4e9442379b2a53e3fbc65dd981062d2c","observation_id":"5c5da228-09e3-4232-be7f-2f81cea366a7","resolution":{"observed_at":"2026-08-02T13:31:46.310579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-01T14:58:15.255937Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-02T13:31:46.313828Z","title":"The ai scientist-v2: Workshop-level automated scientific discovery via agentic tree search.arXiv preprint arXiv:2504.08066, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.313828Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:bd3296f9489b251aab606b799562493d68af2f93b3b895e8321c079100c0c83e","observation_id":"7108ede6-2c89-46b4-8d29-0228351d798f","resolution":{"observed_at":"2026-08-02T13:31:46.313828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.317382Z","title":"Towards end-to-end automation of ai research.Nature, 651(8107):914–919, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.317382Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:a8f4dae734c142094f6462c9e0724146c16c9b7c6d71ff380098be091c4e1716","observation_id":"974ecaba-a978-4927-8a38-da7e409f0951","resolution":{"observed_at":"2026-08-02T13:31:46.317382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-02T13:31:46.320330Z","title":"Towards an ai co-scientist.arXiv preprint arXiv:2502.18864, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.320330Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:5d7088c0c372bfe41bf9f98e72b254ae247f7fbbdf23c45c60bebae653d8b402","observation_id":"f52ec977-db67-4fc9-bbc6-c0440c399c9d","resolution":{"observed_at":"2026-08-02T13:31:46.320330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.02824","last_updated":"2025-11-05T18:26:43Z","snapshot_observed_at":"2026-07-06T22:34:53.346702Z","submitted_at":"2025-11-04T18:50:52Z","title":"Kosmos: An AI Scientist for Autonomous Discovery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.02824","snapshot_observed_at":"2026-08-02T13:31:46.323451Z","title":"Kosmos: An ai scientist for autonomous discovery.arXiv preprint arXiv:2511.02824, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.323451Z"},"links":{"cited_paper":"/paper/2511.02824","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:b0a2abff41b40f27e16fb914dfa9b4aa971a1c6dec47954a3f553d8a0e4334cd","observation_id":"c8e1834e-69f2-4ba3-9029-ccc8384b143a","resolution":{"observed_at":"2026-08-02T13:31:46.323451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.326700Z","title":"Ai for scientific discovery is a social problem.arXiv preprint arXiv:2509.06580, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.326700Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:faec4c83215e2eab343d0cab854cfdfc89f61dfbda08cd13327a2a3292307966","observation_id":"9f7c1f7d-8a55-4abb-b187-8b5c79423ec2","resolution":{"observed_at":"2026-08-02T13:31:46.326700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.330493Z","title":"When will ai exceed human performance? evidence from ai experts.Journal of Artificial Intelligence Research, 62:729–754, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.330493Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:11839493bab2dd925cf57a4a0d8338a02f7ae83a16868696308bc3a30bf4aab2","observation_id":"f5919fb8-2963-4818-b76a-0b0d41bc68c1","resolution":{"observed_at":"2026-08-02T13:31:46.330493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05282","last_updated":"2025-04-09T11:34:12Z","snapshot_observed_at":"2026-08-03T19:50:55.239079Z","submitted_at":"2024-11-05T15:47:23Z","title":"International Scientific Report on the Safety of Advanced AI (Interim Report)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05282","snapshot_observed_at":"2026-08-02T13:31:46.333346Z","title":"In- ternational scientific report on the safety of advanced ai (interim report).arXiv preprint arXiv:2412.05282, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.333346Z"},"links":{"cited_paper":"/paper/2412.05282","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:1089be5cf73b94d7e6d6b63d824370f7edb11a43db98c5b226fff943c1fe4cb3","observation_id":"5a1ff58b-bd6e-4061-bb73-028c3b9c018b","resolution":{"observed_at":"2026-08-02T13:31:46.333346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.336632Z","title":"Frontierscience: Evaluating ai’s ability to perform expert-level scientific tasks.arXiv preprint arXiv:2601.21165, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.336632Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:099b7dca66d911868cf6dd5fcebcbd3c5b2f23c32defc3c9d7f78096f9bdc297","observation_id":"c58aecf6-7064-4024-8e64-0c1d3189d99a","resolution":{"observed_at":"2026-08-02T13:31:46.336632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04872","last_updated":"2025-12-23T02:23:47Z","snapshot_observed_at":"2026-08-04T15:54:46.196160Z","submitted_at":"2024-11-07T17:07:35Z","title":"FrontierMath: A Benchmark for Evaluating Advanced Mathematical Reasoning in AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04872","snapshot_observed_at":"2026-08-02T13:31:46.340326Z","title":"Frontiermath: A benchmark for evaluating advanced mathematical reasoning in ai.arXiv preprint arXiv:2411.04872, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.340326Z"},"links":{"cited_paper":"/paper/2411.04872","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:457be54d7e7b8b75632de023648d09b3589da0379099ac5a50039de29e4e97fc","observation_id":"7c4509d2-bd4f-46b1-865c-5527f222b8df","resolution":{"observed_at":"2026-08-02T13:31:46.340326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.343440Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.343440Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:47df74aa76feb75d1a1da8c64a91ceecd43dfdd4ccd5f2fe3add6cc5ae2af4ff","observation_id":"c0a60e5a-f868-4a7c-8127-e964c2b6e70e","resolution":{"observed_at":"2026-08-02T13:31:46.343440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.346184Z","title":"Forecasting future world events with neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.346184Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:eaf7b26a688189a5128bb6060d27ccc85fa9e5b9a07047c373878c06c8637c60","observation_id":"fb973199-10c6-43cf-8f08-c7fcadd0a9ac","resolution":{"observed_at":"2026-08-02T13:31:46.346184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.348625Z","title":"Approaching human-level forecasting with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.348625Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:0e12293c4a2fa95b99bd113aa815d9b77f392adbc0c94fed98e11aeb0783367e","observation_id":"dbde5f65-b8df-4274-b1c7-2ae9a814695b","resolution":{"observed_at":"2026-08-02T13:31:46.348625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.350973Z","title":"Benchmark self-evolving: A multi-agent framework for dynamic llm evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.350973Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:dc243834f5239c41006077ac1eb1bd315ee0715174a1a310b7e89b81296207eb","observation_id":"9659dd89-b414-4881-9a60-8da75749cb8c","resolution":{"observed_at":"2026-08-02T13:31:46.350973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.353686Z","title":"Truthtensor: Evaluating llms through human imitation on prediction market under drift and holistic reasoning.arXiv preprint arXiv:2601.13545, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.353686Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:47e5d80ed01b4b3f7e1843f8a2ee3be3075ada9769d1a8f081b73461937f8a61","observation_id":"581a0c1f-e71f-4dea-8450-9a0d542af865","resolution":{"observed_at":"2026-08-02T13:31:46.353686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19314","snapshot_observed_at":"2026-08-02T13:31:46.356124Z","title":"Livebench: A challenging, contamination-limited llm benchmark.arXiv preprint arXiv:2406.19314, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.356124Z"},"links":{"cited_paper":"/paper/2406.19314","citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:1d8b1341952e2b37080023466546d3197f751c6484dbc59db6f077797848e620","observation_id":"317b0f04-0a13-4d8e-9fd0-49109909d80f","resolution":{"observed_at":"2026-08-02T13:31:46.356124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.358787Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.358787Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:dd6d60bc53d331fc237999cbcfb3a8966aa77907586b66530a29f5fa38ce2694","observation_id":"cadcdfd6-ad82-4f99-bd96-17e781b858ad","resolution":{"observed_at":"2026-08-02T13:31:46.358787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.361426Z","title":"Paradigm shifts as portals to threshold concepts and epistemic transfor- mation.Educational Philosophy and Theory, pages 1–12, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.361426Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:c94659d5d8b2a58a83aca1a10da1ab499c89f0a2e504606e37dea43ed6cbe920","observation_id":"12a4ae18-ea43-4d0d-9fdf-6c1d6fe1ebed","resolution":{"observed_at":"2026-08-02T13:31:46.361426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.363794Z","title":"Scientific novelty beyond the experiment.Microbial Biotechnology, 16(6):1131–1173, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.363794Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:4d7cda75c413f6442f6a4eeb7b61bf6b72a19eeb765d038110315ad1fad18732","observation_id":"493849dd-0a56-4dc9-9d29-2294c0241bca","resolution":{"observed_at":"2026-08-02T13:31:46.363794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.366245Z","title":"Nature of metal-support interaction for metal catalysts on oxide supports.Science, 386(6724):915–920, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.366245Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:22622016f652d554559f8ba852f222f68246c4bcdb3837827c2a957540ce9fff","observation_id":"8217572e-4928-43dd-8c25-392d106622d0","resolution":{"observed_at":"2026-08-02T13:31:46.366245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.368648Z","title":"Functional gradients facilitate tactile sensing in elephant whiskers.Science, 391(6786):712–718, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.368648Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:0f6cc96998cc62ffb7ce27a788937d1261681c14797ac6275bb06e2e1e0119bf","observation_id":"ffdf156a-4cc8-4c14-b23b-78fa25ca4a7f","resolution":{"observed_at":"2026-08-02T13:31:46.368648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.371142Z","title":"Electromagnetic interference shielding using metal and mxene thin films.Nature, pages 1–8, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.371142Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:f38c537c671a21c4f36a75ba8f7aaba89e2236eebbab5d418c34ffba809535d6","observation_id":"6e30323c-98eb-409a-b236-a099e95ed8bd","resolution":{"observed_at":"2026-08-02T13:31:46.371142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.374163Z","title":"Rpg: A repository planning graph for unified and scalable codebase generation.arXiv preprint arXiv:2509.16198, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.374163Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:b5be15d7dfbdd03a19fe95a7a67ca506bfee79fe261acee0206753e29cb49611","observation_id":"53598241-520d-4409-b35b-8552a3df938a","resolution":{"observed_at":"2026-08-02T13:31:46.374163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.377128Z","title":"A smart mask for exhaled breath condensate harvesting and analysis.Science, 385(6712):954–961, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.377128Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:16a7423b74ee459ebfc6c2ad590578972caf77614eb496c81e4d924bf1cac625","observation_id":"e9b75c43-217f-470c-b1e8-1b13beadc3fc","resolution":{"observed_at":"2026-08-02T13:31:46.377128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.379456Z","title":"Comprehensive echocardiogram evaluation with view primed vision language ai.Nature, 650(8103):970–977, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.379456Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:59b478b0e365af7a440db900179e6d9dde17b34490bdb56d9a1e7918721d49e3","observation_id":"634ff5b3-c391-49ea-bffc-08eab9da8099","resolution":{"observed_at":"2026-08-02T13:31:46.379456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.381952Z","title":"Top 10 AI Papers of the Week","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.381952Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:c7fdf09dc04eb626a46bd773d022c10b4b14ef0dba4fbd8f38254dd9bc41c613","observation_id":"f65bdcce-867c-48d6-82d5-7821ecc060c6","resolution":{"observed_at":"2026-08-02T13:31:46.381952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.386278Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.386278Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:54dc15ac11672c025f0de7d9b834198d9bc818a1ec7890bc92da57768cfa1857","observation_id":"d8196c2f-179e-429a-92c9-26986ab3ef37","resolution":{"observed_at":"2026-08-02T13:31:46.386278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.388791Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.388791Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:fa4b894b874ff10c78dc25d66499b6812de967b18533037b8f26ee7da9e61c75","observation_id":"84aff2d1-ef50-4bd5-85d4-143984ecb7bd","resolution":{"observed_at":"2026-08-02T13:31:46.388791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.391375Z","title":"verdict\":","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.391375Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:e5398cb7d2061c4574d17ecdfb787f079568418baff3a2d05938c647fa96caf1","observation_id":"b1c09010-b5d2-446b-96fc-cfaac393a67c","resolution":{"observed_at":"2026-08-02T13:31:46.391375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.394125Z","title":"‘json code block. Write 1-2 sentences of reasoning with inline citations ( [title](url)) before the block. {","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.394125Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:750bb7ad52ea6d130fed0adfd06626a7423ed00748c2968888fb715407597570","observation_id":"7224587a-65c2-4b8d-9487-d1f1b3497eb8","resolution":{"observed_at":"2026-08-02T13:31:46.394125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.397104Z","title":"Do NOT change which benchmark or dataset is referenced","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.397104Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:481429897191331e5b28e0757ee048f420136ac1ad7a2f327ef74530d3228900","observation_id":"7a7b78ab-2119-4d98-8c3d-9612c94886b1","resolution":{"observed_at":"2026-08-02T13:31:46.397104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.399631Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.399631Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:1e308f735ad2560f16610137c101a03ed2bdcb3a802bd0346da08d19ca27686b","observation_id":"8596b3aa-4bef-4e13-99db-a91d7acc72bb","resolution":{"observed_at":"2026-08-02T13:31:46.399631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.402131Z","title":"Make the increase a clear shift so there is no ambiguity, but still physically plausible","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.402131Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:6927c00e290c4dc9c4c88badd4d17b6dc8c7e6047c76c6dc7633f5af8c3732b2","observation_id":"fb6f5fcf-3dd7-49cb-b75d-7b3d11d9abe4","resolution":{"observed_at":"2026-08-02T13:31:46.402131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.404818Z","title":"Make this constraint significant enough that it’s noticeably harder to satisfy than the original","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.404818Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:fa0ab0f62b647c767d74b48bc4a8d8975447ffa5efe11753e52470c8468cce42","observation_id":"76a3016c-99e7-4256-9999-8d1d5f94b5ae","resolution":{"observed_at":"2026-08-02T13:31:46.404818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.407528Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.407528Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:18c979b9a2a25fa268cb5317d9b2b4e9b8f159a680282cb612612e360d3c62cb","observation_id":"5d38b8e6-358d-4c10-94bb-24e9b6dc0a3f","resolution":{"observed_at":"2026-08-02T13:31:46.407528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.409923Z","title":"{problem_statement}","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.409923Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:e1f6db4b3073dca22d8358ce0de247ad39c101818cd24e0b2a9c2bfdc5fb3d28","observation_id":"41f10337-db3b-4d48-a3f7-95578ec7b3b1","resolution":{"observed_at":"2026-08-02T13:31:46.409923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.412723Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.412723Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:75743121e41abb3144b55ae10a46fee2fc2135cfb0134f485acd5ecb2b2cab40","observation_id":"d315d6b0-5ff8-4b93-a6d1-9fdf7ccddf60","resolution":{"observed_at":"2026-08-02T13:31:46.412723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.415267Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.415267Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:25514c3d4779df18fcb5e1877309f369ecda53763dc7acb22b3ea1ebae7507f4","observation_id":"f9580f5c-9f4e-439d-9d7c-af60ab76564e","resolution":{"observed_at":"2026-08-02T13:31:46.415267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:31:46.418313Z","title":"Return JSON with key ‘prompt’","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-02T13:31:46.418313Z"},"links":{"citing_paper":"/paper/2605.22681"},"observation_digest":"sha256:94918f6429f4063adfa8e4f4b937829200baadb5fdf95d26b94db9ba1d421169","observation_id":"a95d6376-82b2-463e-ae18-5e75a19cc798","resolution":{"observed_at":"2026-08-02T13:31:46.418313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.22681","last_updated":"2026-07-18T20:33:32Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T13:31:38.903992Z","submitted_at":"2026-05-21T16:23:36Z","title":"Scientific reasoning does not reliably translate into scientific forecasting in frontier AI"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":76,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 0 inbound Pith citation observations for arXiv:2605.22681."}