{"as_of":"2026-08-19T18:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:36b5042b1c75052bbb02c1a69fe2968896e8f35d51c0d4ac7079d85e0e5f5710","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:17:35.650650Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11415/citation-record","integrity":"/paper/2608.11415/integrity","json":"/paper/2608.11415/citation-record.json","paper":"/paper/2608.11415"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.401879Z","title":"Hanson, Pablo Gomez Barreiro, Paolo Crosetto, and Dan Brockington","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.401879Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:ffaa96596fd3f167a69672e4a23bf1db389b0abe54192962e751891557b5de70","observation_id":"dac64a6f-cd0c-44d2-a35c-f1bf408dbe74","resolution":{"observed_at":"2026-08-15T14:17:35.401879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.819364Z","title":null,"venue":null,"work_id":"7cf51c0d-624b-40ff-a3c3-cbd4058b3b1b","year":1974},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.406795Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:d8e4d5bc9b5a9bda7629cd1b96ec9502db3ebc171968a4fc8516b3def74dd502","observation_id":"3578a5a3-1a5a-487f-bb89-57cb8c12bdd6","resolution":{"observed_at":"2026-08-15T14:17:36.822921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.411182Z","title":"Ross, Alberto Ruano-Ravina, David S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.411182Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:95c92ac84971eea9f5a653377783dad1a7ff9108faa45c5aacc1febee0799d85","observation_id":"e7b48032-d4ef-41fb-835d-571e2a4eedc0","resolution":{"observed_at":"2026-08-15T14:17:35.411182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.415585Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.415585Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:bdc0b271b47ae2f3e9276353276afebeefdc4e08eb112dfd9b4fe1df345ae375","observation_id":"c5f9a539-61b3-463c-a62d-1c0995150991","resolution":{"observed_at":"2026-08-15T14:17:35.415585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.419923Z","title":"Towards end-to-end automation of AI research.Nature, 651(8107):914–919, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.419923Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:0cbbf11c21615f05f4578fa09aad34480cf3eb8f5b8c4a2eac7a311bb5457170","observation_id":"505a8a6b-8921-4e29-a6f5-8d87c0549818","resolution":{"observed_at":"2026-08-15T14:17:35.419923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2502.14297","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.152700Z","title":"Evaluating Sakana’s AI Scientist: Bold claims, mixed results, and a promising future? 2025","venue":null,"work_id":"39a4abca-1dcb-4726-b4d1-3f5ca2d72469","year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.424431Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:b2d41200e6c89db24a50fb813c80d2b58b2b9e0bfb3a5a3ab565ecf3a7662f5d","observation_id":"e33397cf-34fb-4023-82fa-7a41f7076138","resolution":{"observed_at":"2026-08-15T14:17:36.158120Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.02824","last_updated":"2025-11-05T18:26:43Z","snapshot_observed_at":"2026-08-17T03:14:20.962319Z","submitted_at":"2025-11-04T18:50:52Z","title":"Kosmos: An AI Scientist for Autonomous Discovery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.02824","snapshot_observed_at":"2026-08-15T14:17:35.430311Z","title":"Landsness, Daniel L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.430311Z"},"links":{"cited_paper":"/paper/2511.02824","citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:1ddba6b6c288de7ec601c77f815635f73adbb7c3459c71a3558e37bc06c64ca3","observation_id":"2dd4ea1e-82a6-4e83-99b7-9afd6225c2ec","resolution":{"observed_at":"2026-08-15T14:17:35.430311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/science.aeh2955","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.063676Z","title":"Department of Energy labs embrace Genesis AI push.Science, 391(6791):1191–1192, 2026","venue":null,"work_id":"e7a85554-ef09-49cb-9bd5-86b23a262969","year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.435786Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:cf4a8b4db32a52d6a70ace6be893e79fba3345616841be872326abd546ea800e","observation_id":"faa23df2-9c92-4452-98d1-6aa9934cae98","resolution":{"observed_at":"2026-08-15T14:17:36.068470Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/science.aeh8590","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.050304Z","title":"Department of Energy’s AI push squeezes scientists.Science, 392(6794):135–136, 2026","venue":null,"work_id":"dacffbcb-421c-469d-a151-6cdbc4dfb562","year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.439603Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:14c77a95b905f84e448cf7d708ff430b6a99c64e236ce57bc3130ff351abe9eb","observation_id":"19fc7b1d-f90c-4ed7-a6fe-3cac57044367","resolution":{"observed_at":"2026-08-15T14:17:36.055735Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.808559Z","title":"ChatGPT and AlphaFold help design personalized vaccine for dog with cancer","venue":null,"work_id":"6b79479b-d341-4af6-a146-cef04990349d","year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.445025Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:2792ddc9b13329c337eb8dd3d11139b290b123966626bbaa46788fc31fceceb8","observation_id":"efdcf075-ea80-477a-aa39-2391b888b18a","resolution":{"observed_at":"2026-08-15T14:17:36.812381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-15T14:17:35.449548Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.449548Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:0ba29baec12bbb4eb94a56c8668710698ddac98f0125f7a06c49c1a2da7e53b2","observation_id":"69b8c3b2-45a1-40b8-8607-d3c4cc1a1d91","resolution":{"observed_at":"2026-08-15T14:17:35.449548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-15T14:17:35.454516Z","title":"Manning, Christopher Re, Diana Acosta-Navas, Drew A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.454516Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:616feb8d868f2ff90231fc820c28f2ddf7f181d6d9e70fe09ea1ec7de156792f","observation_id":"8d899212-080f-46ac-bb18-47eb473eea40","resolution":{"observed_at":"2026-08-15T14:17:35.454516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-18T14:12:03.598270Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-15T14:17:35.460675Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.460675Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:4cce1772e3a873c21b64fcb7c5a7b935269718a0184b4d8f4a42a11de5c0306a","observation_id":"cb2b2bc8-0de2-47d0-8fe9-49a6d4bb33fe","resolution":{"observed_at":"2026-08-15T14:17:35.460675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-08-15T14:17:35.466549Z","title":"A benchmark of expert-level academic questions to assess AI capabilities.Nature, 649:1139–1146, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.466549Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:7b73105738b73bc44df5f3fcfc2b786c1c08558a1873d2f65b6dad7357e1ec07","observation_id":"a6b06783-0137-4976-ac1c-dcab530d6ce7","resolution":{"observed_at":"2026-08-15T14:17:35.466549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.795843Z","title":"FrontierScience: Evaluating AI’s ability to perform expert-level scientific tasks","venue":null,"work_id":"cf283516-c907-40f1-b436-146d55224efe","year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.471142Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:7cef180a955af4a552e886698a4086cbdedc0cfa76eda5750ce446da24903d3e","observation_id":"05476a3a-cf56-4682-a7e8-d31df624c23d","resolution":{"observed_at":"2026-08-15T14:17:36.800472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41591-026-04431-5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.002926Z","title":"Neifert, Cordelia Orillac, Nataniel J","venue":null,"work_id":"e785a859-ec65-43e6-89e5-d8d55fac05df","year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.475114Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:2c5b07e48b6bdc1c5f177ff1af1879055a89850f00c2226aabf679ff28e342d1","observation_id":"22c4e24f-3d4d-429f-87d6-6dec3741cd0f","resolution":{"observed_at":"2026-08-15T14:17:36.006815Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.664","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.989172Z","title":"Lexical recall or logical reasoning: Probing the limits of reasoning abilities in large language models","venue":null,"work_id":"8ebdb31b-cbaf-452a-83bd-fb1b600701a6","year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.479605Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:1513d51704c0e5573586a3fd6a6d22c99f9eb16d005e152fa8ac3fe445684ef8","observation_id":"37ed2e75-6b94-4b1a-8b00-3faa028ab527","resolution":{"observed_at":"2026-08-15T14:17:35.994147Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01100","last_updated":"2025-07-15T01:14:25Z","snapshot_observed_at":"2026-08-18T19:02:23.250634Z","submitted_at":"2025-02-03T06:44:49Z","title":"ZebraLogic: On the Scaling Limits of LLMs for Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01100","snapshot_observed_at":"2026-08-15T14:17:35.483588Z","title":"Zebralogic: On the scaling limits of LLMs for logical reasoning.arXiv preprint arXiv:2502.01100, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.483588Z"},"links":{"cited_paper":"/paper/2502.01100","citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:07f44bd6defd428119a1b5aa1242e9d48560476e237d86377067cdb8aa1a74b7","observation_id":"6d00b62a-cbf9-4f17-bb51-2e13c658fdf1","resolution":{"observed_at":"2026-08-15T14:17:35.483588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-08-16T20:15:33.207365Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-15T14:17:35.487520Z","title":"Chen, Xikun Zhang, and Dacheng Tao","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.487520Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:227a5250d0ae31c4b2947b9f14070703482af505c4f71f5364f8497396c8bc77","observation_id":"4bf7c91d-487c-49b5-926e-b7e04d07a5cb","resolution":{"observed_at":"2026-08-15T14:17:35.487520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0140-6736(97)11096-0","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.966692Z","title":null,"venue":null,"work_id":"4c8c51b8-2c43-4b76-b1e4-c3d67c770d1a","year":1998},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.491431Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:37bee6bc2fc07160156305052200421df1ecef9f40151f236442bca47e48781f","observation_id":"e68d5cab-7295-400f-8f0e-867aff774502","resolution":{"observed_at":"2026-08-15T14:17:35.970987Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-15T18:17:56.703592+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1016/s0140-6736(04)15715-2","provenance":{"observed_at":"2026-07-08T21:54:33.364163+00:00","source":"retraction_watch","source_record_id":"17269"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.710412+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1016/s0140-6736(10)60175-4","provenance":{"observed_at":"2026-07-08T21:54:40.557535+00:00","source":"retraction_watch","source_record_id":"4036"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.11460","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.649624Z","title":null,"venue":null,"work_id":"415319cd-dce5-4b21-8122-152f9197cd95","year":2020},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.495248Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:5b7321b0d4d3d9cba1d911dbd22e6c6f9bc1c536f4a41ac3eade52354df4408e","observation_id":"b43cfea2-bbd7-4298-b6ce-c36808680db3","resolution":{"observed_at":"2026-08-15T14:17:36.654918Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"pii/0022072","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.567456Z","title":"Electrochemically induced nuclear fusion of deuterium.Journal of Electroanalytical Chemistry and Interfacial Electrochemistry, 261(2, Part 1):301–308, 1989","venue":null,"work_id":"0a001d2d-6eaf-46b7-8db6-2c00b78e077c","year":1989},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.499142Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:a80dc3b8896cad659e24442cadc4ca960476db9e62be49d4a370c377933cfb82","observation_id":"d46d944a-23ab-4594-98f0-ec135338520a","resolution":{"observed_at":"2026-08-15T14:17:36.573774Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3889/oamjms.2019.769","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.783487Z","title":null,"venue":null,"work_id":"ca1d815b-ff7a-496f-b92a-b335cf92c4e4","year":2019},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.507406Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:20bce7664f082534b53fc03ad9192151e9943ec3256d096f27f8aaf76bd9c0e7","observation_id":"a4261df8-c381-4978-b74b-43fecbb50d77","resolution":{"observed_at":"2026-08-15T14:17:36.788030Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3934/biophy.2022030","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.953715Z","title":"A mathematical model for inducing T-cells around tumor cells by using exchanged waves between graphene sheets interior and exterior of body.AIMS Biophysics, 9(4):388–401, 2022","venue":null,"work_id":"9907f758-1156-41d4-af4b-b694199e80a0","year":2022},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.510822Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:6feb67dd97bc228a07ec36f52cbe8dacbdb36495336fc7c7f305d9388ba9074a","observation_id":"3b01bfa8-ae7d-4a6f-b7c3-39e386a30574","resolution":{"observed_at":"2026-08-15T14:17:35.958851Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.00139","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.435302Z","title":"Marvin Herndon","venue":null,"work_id":"42ac0e82-280e-4619-9c25-9a83d6191cdc","year":2016},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.514917Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:ecb5ab756d1a3df55094214d90211a169e085fb68c6ac96b30d959f1b9c02ac1","observation_id":"465d977a-0dea-4702-a2c7-657d5eb31362","resolution":{"observed_at":"2026-08-15T14:17:36.440770Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.518773Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.518773Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:620c3aa116a5a527b52e7c55c4cb46d5c226483312ca3207f81629f62314e745","observation_id":"d0c711f9-fa31-48c3-bfb7-6f5a9e3cbb27","resolution":{"observed_at":"2026-08-15T14:17:35.518773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1073/pnas.0407162101","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.941570Z","title":"Epel, Elizabeth H","venue":null,"work_id":"75cdf217-13c5-4d78-b14d-fde9fd347039","year":2004},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.522488Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:eaabb7b43c941496f3e2c19082c9faf1020be799ef7cc9eae63faee3176a261d","observation_id":"5c11f369-38ad-4960-ab94-8c9d2624cf5f","resolution":{"observed_at":"2026-08-15T14:17:35.945731Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0140-6736(08)61598-6","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.928597Z","title":"RETRACTED: Clinical transplantation of a tissue-engineered airway.The Lancet, 372(9655):2023–2030, December 2008","venue":null,"work_id":"898b5042-3915-4ef1-8d70-7a9b7548830e","year":2023},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.526428Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:71d3271f776fc90e12e9f48cecb79888bf28e0c972cad532edc39db526b42664","observation_id":"18f62e1f-feae-4cb9-aaf5-ffd75ec0521c","resolution":{"observed_at":"2026-08-15T14:17:35.933620Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-15T18:17:56.655371+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1016/s0140-6736(23)02341-3","provenance":{"observed_at":"2026-07-08T21:54:13.905845+00:00","source":"retraction_watch","source_record_id":"48567"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.663619+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"correction","notice_doi":"10.1016/s0140-6736(19)31562-4","provenance":{"observed_at":"2026-07-08T21:54:17.92451+00:00","source":"retraction_watch","source_record_id":"42607"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.670686+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1016/s0140-6736(23)00293-3","provenance":{"observed_at":"2026-07-08T21:54:17.925145+00:00","source":"retraction_watch","source_record_id":"42606"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.530047Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.530047Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:1f94dcd32f01648771024d03480b8fab01778d729561cef61fcc1f211a10267b","observation_id":"d13ece3e-e46b-4da0-af59-79184b410a8c","resolution":{"observed_at":"2026-08-15T14:17:35.530047Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/eurheartj/ehz098","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.916335Z","title":"Cardiac stem cells in the post-anversa era.European Heart Journal, 40(13):1039–1041, 04 2019","venue":null,"work_id":"da6b5c25-52e0-43e2-a518-c271b947904f","year":2019},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.534136Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:c8a5bb09bb1d79ada7c3687f759e4384ef5a6bcd840cca1de76ffeb07d7877c3","observation_id":"69dc66cb-b9fe-4f03-8fb1-ad088e5c69b5","resolution":{"observed_at":"2026-08-15T14:17:35.920527Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12037","last_updated":"2023-08-11T08:05:31Z","snapshot_observed_at":"2026-08-16T15:14:09.488561Z","submitted_at":"2023-07-22T10:11:28Z","title":"Superconductor Pb$_{10-x}$Cu$_x$(PO$_4$)$_6$O showing levitation at room temperature and atmospheric pressure and mechanism","version":3},"cited_work":{"arxiv_id":"2307.12037","doi":"10.48550/arxiv.2307.12037","metadata_source":"pith","pith_arxiv_id":"2307.12037","snapshot_observed_at":"2026-08-15T18:16:14.067578Z","title":"Superconductor Pb$_{10-x}$Cu$_x$(PO$_4$)$_6$O showing levitation at room temperature and atmospheric pressure and mechanism","venue":"cond-mat.supr-con","work_id":"6179f3d9-b663-40e0-b7e1-005ca5c54733","year":2023},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.538326Z"},"links":{"cited_paper":"/paper/2307.12037","citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:6d49bb19d4853009ac87adff02f155d835f7c381b84690b06c4f6fa808b90f43","observation_id":"ea6f78cb-f192-44de-ac0e-c137703a316d","resolution":{"observed_at":"2026-08-15T14:17:35.907824Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-020-2801-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.889756Z","title":"Lawler, Ashkan Salamat, and Ranga P","venue":null,"work_id":"fe5facb2-0d28-4dcc-ab59-53823ce0725e","year":2020},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.542846Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:a81966a88af827b981f7eb591e58445383cb5977e1574fe8577cda05e0a926e5","observation_id":"d9ecef53-d712-4559-b5bb-5485c17933d3","resolution":{"observed_at":"2026-08-15T14:17:35.893712Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-15T18:17:58.187992+00:00","source":"paper_reference_links","state":"open"},"event_date":"2020-11-19","event_type":"correction","notice_doi":"10.1038/s41586-020-2955-8","provenance":{"observed_at":"2026-07-11T03:03:57.396829+00:00","source":"crossref","source_record_id":"10.1038/s41586-020-2955-8->10.1038/s41586-020-2801-z:correction"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.785775+00:00","source":"paper_reference_links","state":"open"},"event_date":"2022-09-26","event_type":"retraction","notice_doi":"10.1038/s41586-022-05294-9","provenance":{"observed_at":"2026-07-11T02:53:26.532813+00:00","source":"crossref","source_record_id":"10.1038/s41586-022-05294-9->10.1038/s41586-020-2801-z:retraction"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.67701+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1038/s41586-020-2801-z","provenance":{"observed_at":"2026-07-08T21:54:20.043167+00:00","source":"retraction_watch","source_record_id":"39366"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.683927+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1038/s41586-020-2801-z","provenance":{"observed_at":"2026-07-08T21:54:20.043798+00:00","source":"retraction_watch","source_record_id":"39365"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.690769+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1038/s41586-022-05294-9","provenance":{"observed_at":"2026-07-08T21:54:20.044402+00:00","source":"retraction_watch","source_record_id":"39364"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.696859+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1038/s41586-022-05294-9","provenance":{"observed_at":"2026-07-08T21:54:20.045017+00:00","source":"retraction_watch","source_record_id":"39363"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.matt.202","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.878041Z","title":"Constructing two-dimensional holey graphyne with unusual annulative π-extension.Matter, 5(7):2306–2318, 2022","venue":null,"work_id":"7d6c962a-1d48-4f74-92d4-beb01efc5807","year":2022},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.547941Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:cbb341b97b7eae493602334884d96f52b8bc96cb800e409f53ab781919326b1c","observation_id":"f88e0ca9-b8eb-4721-aa08-ba6a4b82f241","resolution":{"observed_at":"2026-08-15T14:17:35.882981Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/a0021524","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.866217Z","title":null,"venue":null,"work_id":"a4f09dd1-a8fe-454b-8f04-3042a52d4e01","year":2011},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.552545Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:08f4986e54aa12a8ceaca5beeed461a49c11ba9f019113b14e3587acff14e648","observation_id":"ae73e88f-6d16-4fae-97c5-105a30a90c7c","resolution":{"observed_at":"2026-08-15T14:17:35.870517Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.4103/0973-6131.98","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.854406Z","title":"Protracted parahippocampal activity associated with Sean Harribance.International Journal of Yoga, 5(2):140, 2012","venue":null,"work_id":"d756c918-43dc-4e44-8ac5-cd740e8b8aff","year":2012},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.557161Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:bec920ee16b92ba24a78fb20a857439b8914b4049289b0a6aace520495df65e1","observation_id":"d40a70fe-c20b-4d86-8723-a86ce686728d","resolution":{"observed_at":"2026-08-15T14:17:35.858532Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/1534735419840797","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.840693Z","title":"Rhea, Tara L","venue":null,"work_id":"8a0c5874-00bf-417e-ab9b-087205c0de5f","year":2019},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.565876Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:9352aee2d9f1a0447cf1c01569e36b2d1b6dda8157e67468c33d29e24058cbcc","observation_id":"9c0aec69-7168-4b81-9bad-52a348688e5b","resolution":{"observed_at":"2026-08-15T14:17:35.846632Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1155/2014/495379","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.828535Z","title":null,"venue":null,"work_id":"de2c18e4-d8eb-4fc3-b301-3ede157f306c","year":2014},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.570920Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:2c248f6df367c638cbf5402b220faab85611dc8d97ed6b2f9ba89090a9ce8546","observation_id":"86939f39-9ce3-40ff-9e2c-5bfd932e0054","resolution":{"observed_at":"2026-08-15T14:17:35.832552Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jep.2010.09.014","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.814870Z","title":"Study on the cold and hot properties of medicinal herbs by thermotropism in mice behavior.Journal of Ethnopharmacology, 133(3):980–985, 2011","venue":null,"work_id":"c83ad316-f60f-496d-a6f2-22a23ad7903a","year":2011},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.575362Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:5eb588bc954df305f75b072ba49ad4750ef3be63adc73309a3c37981cfa93881","observation_id":"3d7d47c7-0333-4b17-93a3-ef18ad2d1aef","resolution":{"observed_at":"2026-08-15T14:17:35.819316Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.751697Z","title":"Probing the Qi of traditional chinese herbal medicines by the biological synthesis of nano-Au.Journal of Materials Chemistry B, 6(19):3156–3162, 05","venue":null,"work_id":"69586505-eec8-4de5-bed0-8b984a1cab85","year":null},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.579271Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:38f4979e93e7c78a3b14da4c6eae1750edcd629409be416e6a7476fd643865b7","observation_id":"0f000eda-0005-475b-a0c5-28c315a3aaf4","resolution":{"observed_at":"2026-08-15T14:17:36.755493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.11648/j.ajac.20160404.13","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.791167Z","title":null,"venue":null,"work_id":"6a310d55-cd1e-4891-8782-f406bafb2448","year":2016},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.588540Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:d90b6912877a896611fcadd8bb5c982607a663bfdf118787790949f918285645","observation_id":"8e26dc71-cf79-432f-92fa-80fb511bd429","resolution":{"observed_at":"2026-08-15T14:17:35.795317Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.740847Z","title":"mistralai/Mistral-Large-3-675B-Instruct-2512","venue":null,"work_id":"fce2a865-32e5-4bb0-8d4b-6d5ca75fce6d","year":2025},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.593193Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:5dddb117d7b87412d5a022a8716bd555824034bdfec4c40691115acf9774c99c","observation_id":"b8f6edb4-6241-4d96-bc7b-e7dc06221258","resolution":{"observed_at":"2026-08-15T14:17:36.744530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.730626Z","title":"Schneider, K","venue":null,"work_id":"0477ec6d-9496-4d4b-8015-f89a9ef6073a","year":2021},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.596595Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:37d41f2ac35da9037a522d663856b06fbc6a6dc2c9104507cdaa5012238bc376","observation_id":"aa7f1930-4d22-47f3-91c8-deb1d4a8276b","resolution":{"observed_at":"2026-08-15T14:17:36.733788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1021/acsomega.2c05293","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.766999Z","title":"Hettiarachchi, Yohanka Perera, Shashiprabha P","venue":null,"work_id":"6d30b20e-87f9-4bef-b5ce-717eb6a5539a","year":2022},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.604255Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:95df77323550c24b8ab9765a549f87d09c5e8039eb405adfe3296838056e4b2e","observation_id":"1fffce2b-3868-4047-9e37-51edacfc75e6","resolution":{"observed_at":"2026-08-15T14:17:35.771065Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-023-46898-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.755115Z","title":"Retracted article: Sciadopitysin mitigates spermatological and testicular damage instigated by paraquat administration in male albino rats.Scientific Reports, 13(1), November 2023","venue":null,"work_id":"fc066215-377d-4fa5-aede-cce78a870935","year":2023},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.608055Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:e099685962eee598e42348a72c59cc35881c727ecaceb755aaa711eebad9a068","observation_id":"7d838227-fead-49a2-ac5e-76046ef184f0","resolution":{"observed_at":"2026-08-15T14:17:35.759470Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-15T18:17:56.744795+00:00","source":"paper_reference_links","state":"open"},"event_date":"2024-11-25","event_type":"retraction","notice_doi":"10.1038/s41598-024-80085-y","provenance":{"observed_at":"2026-07-11T02:51:55.314772+00:00","source":"crossref","source_record_id":"10.1038/s41598-024-80085-y->10.1038/s41598-023-46898-z:retraction"}},{"edge_observation":{"observed_at":"2026-08-15T18:17:56.590571+00:00","source":"paper_reference_links","state":"open"},"event_date":null,"event_type":"retraction","notice_doi":"10.1038/s41598-024-80085-y","provenance":{"observed_at":"2026-07-08T21:54:01.400756+00:00","source":"retraction_watch","source_record_id":"66403"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.sjbs.2021.06.022","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.743159Z","title":"Alanazi, Nawaf Alsaif, Tanveer A","venue":null,"work_id":"4b108728-c16d-42a5-8343-6e1a67a38ab2","year":2021},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.612562Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:f9467f92d2e92951b31d63cb6a0de22d373558d1b27d8fa305de75efe5318298","observation_id":"ec01fdbb-5fd3-4755-be21-7352d7df2af0","resolution":{"observed_at":"2026-08-15T14:17:35.746943Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11011-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.730602Z","title":"RETRACTED ARTICLE: Amelioration of intrac- erebroventricular streptozotocin-induced cognitive dysfunction by Ocimum sanctum L","venue":null,"work_id":"f18b3b2d-4472-4e69-9a5e-c8ac2e1dda3a","year":2022},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.616484Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:c87e6a1e0d2d330de774be299b0cbf171247243cb5c3c27ff2df33f5f64f6445","observation_id":"826899b1-b8a1-463c-9e45-71ba3cdbb20e","resolution":{"observed_at":"2026-08-15T14:17:35.734878Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1021/acsomega.2c06215","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.718732Z","title":null,"venue":null,"work_id":"d7889f01-963b-4ce9-bf5e-5e659f3614bf","year":2022},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.620378Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:74c8a647b7ae45235c632bf164a742e7cdd07d87e70b22f855cfd3955f34ff8c","observation_id":"bd3b79dc-92d9-4174-99cc-4ef87f8c2868","resolution":{"observed_at":"2026-08-15T14:17:35.723002Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1207/s15327914nc330201","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.705354Z","title":"Evaluation of pancreatic proteolytic enzyme treatment of adenocarcinoma of the pancreas, with nutrition and detoxification support.Nutrition and Cancer, 33(2): 117–124, 1999","venue":null,"work_id":"17032416-37e3-4c28-a1fe-6da620c5dc8f","year":1999},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.624026Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:9a8f2c7477944f45c30fa38ce576d2aa38dbcf2763011f2bf247e3bafdb68064","observation_id":"3c31c02c-c8ba-4de3-8a3c-0be36f5331b0","resolution":{"observed_at":"2026-08-15T14:17:35.709765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/jnci/djx145","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.690991Z","title":"Use of alternative medicine for cancer and its impact on survival.JNCI: Journal of the National Cancer Institute, 110(1):121–124, 01 2018","venue":null,"work_id":"8f04f9cd-f533-43e4-a9da-43deaa39c5bb","year":2018},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.627937Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:bc4ade21addeeedc3907483b1b15afa75c5d50bf1af65498039cb059ae86d892","observation_id":"1b538a13-091e-4de7-9fe3-5e80eeacd606","resolution":{"observed_at":"2026-08-15T14:17:35.697114Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.2487","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.267964Z","title":"Johnson, Henry S","venue":null,"work_id":"6dcbed65-16be-419e-b8a7-3d15ca14a9b1","year":2018},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.631926Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:eaa19f1673692965f41c84d38899c0a35f7efe89366f7e42709f4816b1fc1188","observation_id":"ccb2cee6-deb5-468a-9b45-c0901cac51fc","resolution":{"observed_at":"2026-08-15T14:17:36.274643Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.635634Z","title":"Gber, and Nnenna A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.635634Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:0914621315a9c217e5d0b98abfac76488baac4199228022084d6aa80fb4f3dc2","observation_id":"a3c3c9be-820e-4dfa-b39b-7ed0197dc255","resolution":{"observed_at":"2026-08-15T14:17:35.635634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.720103Z","title":"Claude Fable 5 and Claude Mythos 5","venue":null,"work_id":"b0962e33-da39-43c9-9564-dec28093fe81","year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.638960Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:330d284b3d6ed511d9b2ff4b5a2d10b20458bc42dbe53aabf52e9ac428685dd8","observation_id":"68c0f5e7-89f4-4214-abbe-d3a283d19cd6","resolution":{"observed_at":"2026-08-15T14:17:36.723321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.706160Z","title":"Statement on the US government directive to suspend access to Fable 5 and Mythos 5","venue":null,"work_id":"9adddb47-a2bb-4d7e-9cb2-e43289112338","year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.642684Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:944f2eebb0e07b2d0377a2a8270a8187770bf553d96b31a24edb725d1488a113","observation_id":"670055ea-7756-4b58-88d5-34b62c13d471","resolution":{"observed_at":"2026-08-15T14:17:36.711894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.694208Z","title":"Anthropic says Trump admin has lifted export controls on claude Fable 5 and Mythos 5","venue":null,"work_id":"08fef408-c020-460f-94ee-41aa2516e060","year":2026},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.647099Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:31c42b2d1e130c7239d120a2c7d9af89576244c4798109bbff0d48080f3571b6","observation_id":"3fc27788-fd16-423e-baa1-dff98dfdea13","resolution":{"observed_at":"2026-08-15T14:17:36.698430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.progsu","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.507672Z","title":"nutritional therapy","venue":null,"work_id":"b9a10075-36a1-41ee-a786-234472ff7f90","year":2010},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.650650Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:8727660d82bd26f1b127bf1d1101a99208aa2cee9d42328bb813c93be742d397","observation_id":"add6c196-54c5-4dc9-803c-28314b076c34","resolution":{"observed_at":"2026-08-15T14:17:36.511544Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:36.764049Z","title":null,"venue":null,"work_id":"c754980b-a7b6-4052-a6a8-4064a9b331c4","year":2012},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":238,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.561896Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:e341a7095461204fc6db246b32e55f6d575ffc7b84f7bdfccb8e6b13ee081d9c","observation_id":"91a72210-51df-4c2e-8526-df785f8abb49","resolution":{"observed_at":"2026-08-15T14:17:36.767869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1039/c8tb00068a","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.803300Z","title":"doi: 10.1039/c8tb00068a","venue":null,"work_id":"67e513f1-2ce4-4404-93d5-239f51ace7a4","year":null},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.583763Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:8b77f23b15b0b5ea3eb33b4dfca5b9f8cd77287212c3021e6c8fc6a11d328a2d","observation_id":"23ee8679-6a87-4eb0-804f-0a9368a676ed","resolution":{"observed_at":"2026-08-15T14:17:35.807455Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.32113/cellr4_20214_3132","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:17:35.778724Z","title":"doi: 10.32113/cellr4_20214_3132","venue":null,"work_id":"c8bec2ed-8667-496b-9aa3-97b210fa0390","year":null},"citing_paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T14:17:35.600422Z"},"links":{"citing_paper":"/paper/2608.11415"},"observation_digest":"sha256:b5aceefd6c4529df4501a09bf7bc453bcd3a49e8c8004766694418b1660f51e6","observation_id":"61117e49-a145-4569-8135-f7bdd82a6ce4","resolution":{"observed_at":"2026-08-15T14:17:35.782711Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.11415","last_updated":"2026-08-11T20:30:32Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-19T02:07:29.917218Z","submitted_at":"2026-08-11T20:30:32Z","title":"TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":3,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":15,"verified_exact":31,"verified_fuzzy":8},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2608.11415."}