{"as_of":"2026-08-11T09:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf8fee72a007cd5d41afbc6aeee72f25851c73b40012090eb7919135766afd2a","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:39:03.692877Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07437/citation-record","integrity":"/paper/2608.07437/integrity","json":"/paper/2608.07437/citation-record.json","paper":"/paper/2608.07437"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1305.2016","last_updated":"2018-04-28T10:26:12Z","snapshot_observed_at":"2026-07-06T03:13:00.659828Z","submitted_at":"2013-05-09T06:51:33Z","title":"Stability analysis of fluid flows using Lagrangian Perturbation Theory (LPT): application to the plane Couette flow","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1305.2016","snapshot_observed_at":"2026-08-10T04:39:03.400189Z","title":"Wasserstein and Nicole A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.400189Z"},"links":{"cited_paper":"/paper/1305.2016","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:2e0a2067141c615ea700e15c554d61821d3fdce39ea65241d290141583f08d00","observation_id":"02ee2bb2-7fe8-4c06-b2ee-ce4641c13f46","resolution":{"observed_at":"2026-08-10T04:39:03.400189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07209","last_updated":"2025-05-19T09:44:19Z","snapshot_observed_at":"2026-08-04T10:05:13.497222Z","submitted_at":"2023-06-12T16:12:56Z","title":"Data-Copilot: Bridging Billions of Data and Humans with Autonomous Workflow","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07209","snapshot_observed_at":"2026-08-10T04:39:03.405648Z","title":"Data-copilot: Bridging billions of data and humans with autonomous workflow.arXiv preprint arXiv:2306.07209, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.405648Z"},"links":{"cited_paper":"/paper/2306.07209","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:b543409b16ae9168a9c282adc58efea91544132589d5077cca1e7db17a91486e","observation_id":"f153cbbe-5435-4fe6-bc70-a6848ac07d3b","resolution":{"observed_at":"2026-08-10T04:39:03.405648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.410767Z","title":"Deepanalyze: Agentic large language models for autonomous data science.arXiv preprint arXiv:2510.16872, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.410767Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:f5ecbf313534cef06843b692386845f47348fade98cd8ca4d277e0ac52b2e80e","observation_id":"0d367f4e-3feb-4514-9909-6a82962ea663","resolution":{"observed_at":"2026-08-10T04:39:03.410767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.747597Z","title":"Data interpreter: An llm agent for data science","venue":null,"work_id":"9a844a32-6a23-4307-9926-07c7e7f5c142","year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.415655Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:916d78091ef55c70ca52535e3514125353e58d55839126c15b5cd746cc679ba6","observation_id":"bb3088c0-b3fa-4f21-b3ac-6010955f896f","resolution":{"observed_at":"2026-08-10T04:39:04.752551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.731790Z","title":"Infiagent-dabench: Evaluating agents on data analysis tasks,","venue":null,"work_id":"bfcb9cc0-070f-4fb7-b5cb-7c1e3434481d","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.420634Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:d118894902dd5a9e2e80a26f27e23f700616465b07c62e553903bdcd954e991f","observation_id":"3688e365-d990-471c-8239-cf1a285070ff","resolution":{"observed_at":"2026-08-10T04:39:04.736770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23719","last_updated":"2025-06-30T10:49:21Z","snapshot_observed_at":"2026-08-11T05:06:41.954885Z","submitted_at":"2025-06-30T10:49:21Z","title":"DABstep: Data Agent Benchmark for Multi-step Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23719","snapshot_observed_at":"2026-08-10T04:39:03.430946Z","title":"Dabstep: Data agent benchmark for multi-step reasoning.arXiv preprint arXiv:2506.23719, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.430946Z"},"links":{"cited_paper":"/paper/2506.23719","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:33d1e6c0868f2d072543f914e8083bd027bc241f992e5004766d6e74beb68a11","observation_id":"644faab7-ad14-4c37-b046-38a7b75ab743","resolution":{"observed_at":"2026-08-10T04:39:03.430946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.436223Z","title":"DA-code: Agent data science code gen- eration benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.436223Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:b0cce111d60755d9c995ffb61b5efb5724b3c7d6dc9c16232e8db91c358df7dd","observation_id":"d847d5b0-9d18-44da-930c-7c95e024f0b1","resolution":{"observed_at":"2026-08-10T04:39:03.436223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.715404Z","title":"Are large language models good statisticians?Advances in Neural Information Processing Systems, 37:62697–62731, 2024","venue":null,"work_id":"8b1622dc-1e5a-417d-ab94-a36fae02223f","year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.441812Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:9d7d57ced786dfbbf682adc715508189cc124a0b61930cfdfade57c3fac4edb6","observation_id":"0a10aadc-bd13-43fb-ab13-3168d2574294","resolution":{"observed_at":"2026-08-10T04:39:04.720970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-10T04:39:03.446928Z","title":"React: Synergizing reasoning and acting in language models.arXiv preprint arXiv:2210.03629, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.446928Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a2369acd89983e063ed903b036ba45a3686ac035559d14f2c6ee39d4116d8fa2","observation_id":"9ff204ad-749c-48ef-a97b-da696b13364a","resolution":{"observed_at":"2026-08-10T04:39:03.446928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.698968Z","title":"Ds-1000: A natural and reliable benchmark for 12 data science code generation","venue":null,"work_id":"4bdf21c0-0b2e-4e65-a790-25be9aeb5f98","year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.452234Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:f87490609ca09b24e35c49f2d48ac9c31e916e1d0c4a012bf8a85f6760d54082","observation_id":"4ebded3c-7ce2-497e-a8ad-eeff6bf9b079","resolution":{"observed_at":"2026-08-10T04:39:04.704281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05507","last_updated":"2024-03-11T07:57:59Z","snapshot_observed_at":"2026-07-06T17:13:59.073342Z","submitted_at":"2024-01-10T19:04:00Z","title":"InfiAgent-DABench: Evaluating Agents on Data Analysis Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05507","snapshot_observed_at":"2026-08-10T04:39:03.457120Z","title":"Infiagent-dabench: Evaluating agents on data analysis tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.457120Z"},"links":{"cited_paper":"/paper/2401.05507","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:ca64117ae5ac9082161c06703fa901cbae92abb63ce2b00851ef31190f174e27","observation_id":"c9f45c4b-e365-44ce-94b6-d9d21dcce73d","resolution":{"observed_at":"2026-08-10T04:39:03.457120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13897","last_updated":"2025-02-19T17:31:51Z","snapshot_observed_at":"2026-08-07T18:04:25.069863Z","submitted_at":"2025-02-19T17:31:51Z","title":"DataSciBench: An LLM Agent Benchmark for Data Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13897","snapshot_observed_at":"2026-08-10T04:39:03.461634Z","title":"Datascibench: An llm agent benchmark for data science","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.461634Z"},"links":{"cited_paper":"/paper/2502.13897","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:b38e11cb5dc7b8756f11b98dc111d0fdb3330bf2090fe324307a9ab0c097fd37","observation_id":"b7b4fe64-9111-4aac-8e71-5a507dd9ac22","resolution":{"observed_at":"2026-08-10T04:39:03.461634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07095","last_updated":"2025-02-26T11:57:30Z","snapshot_observed_at":"2026-08-06T21:08:58.653035Z","submitted_at":"2024-10-09T17:34:27Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07095","snapshot_observed_at":"2026-08-10T04:39:03.466801Z","title":"Mle-bench: Evaluating machine learning agents on machine learning engineering.arXiv preprint arXiv:2410.07095, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.466801Z"},"links":{"cited_paper":"/paper/2410.07095","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a0a39a5bc2354648d25f2bf1a2e97ea8b649d15891aaabbb50c45b1911616e0b","observation_id":"c1557f8b-cbf6-4f32-a05c-31576141a4ab","resolution":{"observed_at":"2026-08-10T04:39:03.466801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05307","last_updated":"2024-03-08T13:34:20Z","snapshot_observed_at":"2026-08-11T08:54:24.413748Z","submitted_at":"2024-03-08T13:34:20Z","title":"Tapilot-Crossing: Benchmarking and Evolving LLMs Towards Interactive Data Analysis Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05307","snapshot_observed_at":"2026-08-10T04:39:03.471639Z","title":"Tapilot-crossing: Benchmarking and evolving llms towards interactive data analysis agents.arXiv preprint arXiv:2403.05307, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.471639Z"},"links":{"cited_paper":"/paper/2403.05307","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:6837985587a6ef8eeb46a26f3de24cdb362ee77be333b7c44584b10f8c9de52f","observation_id":"9a176489-9d48-4993-bd21-04ab319deee1","resolution":{"observed_at":"2026-08-10T04:39:03.471639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18223","last_updated":"2025-06-06T06:33:47Z","snapshot_observed_at":"2026-08-09T04:33:54.887419Z","submitted_at":"2025-05-23T09:37:52Z","title":"IDA-Bench: Evaluating LLMs on Interactive Guided Data Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18223","snapshot_observed_at":"2026-08-10T04:39:03.476630Z","title":"Ida-bench: Evaluating llms on interactive guided data analysis.arXiv preprint arXiv:2505.18223, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.476630Z"},"links":{"cited_paper":"/paper/2505.18223","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:d6e1a97a4ccdb9b7e78ec785a3d74b7dea4147f45deccc71a4761c4cf1303279","observation_id":"8837324d-564e-4c35-8c3a-42f6175dc1af","resolution":{"observed_at":"2026-08-10T04:39:03.476630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.481558Z","title":"Fact or fiction: Verifying scientific claims","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.481558Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:7d3381f1fe941257190244daf413cef82bf5915f05b8917167cf689d1ef5d9a9","observation_id":"30637093-fa4e-4b87-9771-5515245c4045","resolution":{"observed_at":"2026-08-10T04:39:03.481558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.673544Z","title":"Sciclaimhunt: A large dataset for evidence-based scientific claim verification","venue":null,"work_id":"e2f339bb-e585-4fef-8c94-56098b6ed3ae","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.486856Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:b1b49c5bb002a59a2253dfac0720b22e6b019c777552f92ae2e51b06d500085e","observation_id":"d8348684-9385-4de9-a54d-6444071f1631","resolution":{"observed_at":"2026-08-10T04:39:04.678309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.658820Z","title":"Musciclaims: Multimodal scientific claim verifi- cation","venue":null,"work_id":"248e986b-2106-4d96-af88-2f0a1d966ed9","year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.491749Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:6694c4c175d1005a909a5b9a35afc12f410896e671df3a09bc18bfc69a577d5f","observation_id":"967c7018-a6b1-49aa-9c25-6282fef5ebaf","resolution":{"observed_at":"2026-08-10T04:39:04.663704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.643636Z","title":"Investi- gating the reproducibility of the social and behavioural sciences.Nature, 652(8108):126–134, 2026","venue":null,"work_id":"7ea99d08-4000-4add-8934-cb12d0b6b36f","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.496445Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:d06d54f1bc3248c779ad2c0e17968823fb6d19f3c6d70a398451e90e276166be","observation_id":"75554491-30c5-42cb-bed5-39805595e3d7","resolution":{"observed_at":"2026-08-10T04:39:04.648515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.500807Z","title":"Towards end-to-end automation of ai research.Nature, 651(8107):914–919, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.500807Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:7976026f6460e3b573ed888ef85411b62d6badfca897613b6c471c1a928c1b42","observation_id":"2e9418d9-cd96-49f7-b8f7-bbdd9163863e","resolution":{"observed_at":"2026-08-10T04:39:03.500807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18705","last_updated":"2025-05-24T13:54:38Z","snapshot_observed_at":"2026-08-07T14:25:00.518662Z","submitted_at":"2025-05-24T13:54:38Z","title":"AI-Researcher: Autonomous Scientific Innovation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18705","snapshot_observed_at":"2026-08-10T04:39:03.505323Z","title":"Ai-researcher: Autonomous scientific innovation.arXiv preprint arXiv:2505.18705, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.505323Z"},"links":{"cited_paper":"/paper/2505.18705","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:8627db777a24c627354b40fd136a15f7fee0bf4e72744f90f86a841315f5a6fd","observation_id":"bb557469-8e70-4498-822e-5276a4c060ee","resolution":{"observed_at":"2026-08-10T04:39:03.505323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-10T03:18:36.275195Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-10T04:39:03.509944Z","title":"The ai scientist-v2: Workshop-level automated scientific discovery via agentic tree search.arXiv preprint arXiv:2504.08066, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.509944Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:eef5bb4832aefee8ab43ad6274b47f6e9f4148028925968931c23b1b750d6ca6","observation_id":"2e96c553-6fcf-4e65-aa12-39d281943fde","resolution":{"observed_at":"2026-08-10T04:39:03.509944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.615876Z","title":"Development economics field experiments (dfeep)","venue":null,"work_id":"0e613022-4cae-4cce-a6a6-a097d8bea8ce","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.514880Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:1805b74ceb0113609ed6099a9dd728c76cd17c9bd9370d84e8071bdf08d1141f","observation_id":"7097c805-7d63-451c-8122-a5b98befa13a","resolution":{"observed_at":"2026-08-10T04:39:04.620868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.599663Z","title":"The cbio cancer genomics portal: an open platform for exploring multidimensional cancer genomics data.Cancer discovery, 2(5):401–404, 2012","venue":null,"work_id":"6b575d35-db63-46b4-bee9-7e6ae05507df","year":2012},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.519472Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:779f7af19fe4a46b5c1ec1b7816bf63a95cdcfcd293da0847c88174b43143391","observation_id":"7af7ec38-d793-45e9-ade6-72a95d998e44","resolution":{"observed_at":"2026-08-10T04:39:04.605005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.583703Z","title":"Integrative analysis of complex cancer genomics and clinical profiles using the cbioportal.Science signal- ing, 6(269):pl1–pl1, 2013","venue":null,"work_id":"9e48aa45-e1fb-4da5-842f-ff4349919a0c","year":2013},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.524397Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a3e951b933c2c758253ecf37b1c7a33524d4624a6b0ca5464ecb001a49a877f1","observation_id":"ba341f71-2d39-4448-8fd2-9d69c49fc373","resolution":{"observed_at":"2026-08-10T04:39:04.588856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16100","last_updated":"2025-05-22T01:02:21Z","snapshot_observed_at":"2026-08-08T09:18:44.401175Z","submitted_at":"2025-05-22T01:02:21Z","title":"BioDSA-1K: Benchmarking Data Science Agents for Biomedical Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16100","snapshot_observed_at":"2026-08-10T04:39:03.528813Z","title":"Biodsa-1k: Benchmarking data science agents for biomedical research, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.528813Z"},"links":{"cited_paper":"/paper/2505.16100","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4ca5df82fdbad345291660a66153bdf3f3a497466aede3253600d9abf1262e54","observation_id":"5b5ffc14-a414-42a7-b78d-11cf301e6476","resolution":{"observed_at":"2026-08-10T04:39:03.528813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.568157Z","title":null,"venue":null,"work_id":"6918af45-45a6-4eae-937e-abcd2e71bcb4","year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.533331Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:5ea72a32159725aba91bb5e1fe21442d909d4230d16d7b2f100c5af07597e76f","observation_id":"06e28d36-989a-43de-885b-022acebdf441","resolution":{"observed_at":"2026-08-10T04:39:04.573011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.551911Z","title":"Introducing claude sonnet 4.6.https://www.anthropic.com/news/ claude-sonnet-4-6, February 2026","venue":null,"work_id":"0a3ae8f5-722b-4903-81e0-175cfa6fcc62","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.537708Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:bcf598d7bf7ec9293cee7d52f197b4513452360b0a557b760f2a362d47d3d781","observation_id":"3509a304-b336-450a-a2e1-85062991a107","resolution":{"observed_at":"2026-08-10T04:39:04.556765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.542160Z","title":"Executable code actions elicit better llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.542160Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:381fd678fb12a58528675d7c218773a88d7ed5bf5eaf507528f0d9d81d7f0ca5","observation_id":"d71be0a8-203a-4c60-a02d-d6a67a1c3ce9","resolution":{"observed_at":"2026-08-10T04:39:03.542160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-10T04:39:03.546532Z","title":"Dapo: An open-source llm reinforcement learning system at scale.arXiv preprint arXiv:2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.546532Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:72564fd4e0f6a75d087354e1d651461d1a5c730b1172cdf653f9ee00d1fca6a2","observation_id":"50d4aaaa-401c-49ae-be49-6e26115c50f2","resolution":{"observed_at":"2026-08-10T04:39:03.546532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-10T04:39:03.550965Z","title":"Qwen2.5-coder technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.550965Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:7b7ed80cafbc1560089463ba8418b494a31f17c24259c1c96fb6465298a3cec6","observation_id":"da19215c-905d-4a00-b296-589b5f48acdf","resolution":{"observed_at":"2026-08-10T04:39:03.550965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.555768Z","title":"Introducing gpt-5.4.https://openai.com/index/introducing-gpt-5-4/, March","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.555768Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:8e7e35da951aef21b0a72e1d16927a2afa5178e381d3f57d3437a0be53a7bd3c","observation_id":"26ec706c-2bf8-4b48-8181-2fbbf363f3cb","resolution":{"observed_at":"2026-08-10T04:39:03.555768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.507739Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence","venue":null,"work_id":"593c00e0-2dff-4057-8a31-29461bfeea8b","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.564690Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:8ed5bfcb87ec704032f05d8bb11d8a649b3dd60e3a5136a0b5f5aa5f42057d4a","observation_id":"71e73ab9-e116-4aed-86a6-0400ae6b77c6","resolution":{"observed_at":"2026-08-10T04:39:04.512901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.491215Z","title":"Introducing gpt-oss.https://openai.com/index/introducing-gpt-oss/, 2025","venue":null,"work_id":"e86a663a-f685-4f8a-b4c6-7c047f479160","year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.569100Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:441bf0f88eb891c2c85174ebdd12c72cf9d5a7a71dfc555b33ddb477cc9ddd60","observation_id":"8c37b627-0242-4fa6-a6dc-129a9b438cbd","resolution":{"observed_at":"2026-08-10T04:39:04.496607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.475835Z","title":"Qwen3-coder-30b-a3b-instruct.https://huggingface.co/Qwen/ Qwen3-Coder-30B-A3B-Instruct, 2025","venue":null,"work_id":"d16dd485-05e6-4656-af50-7934a421aa17","year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.573317Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:e8d4bde4982ea93794daed9921d8826b15d79da9f145f9e1b608655f31df76b6","observation_id":"6402fc39-cc60-48fe-9bb9-27fbc343b7b8","resolution":{"observed_at":"2026-08-10T04:39:04.480535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-10T04:39:03.577579Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.577579Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:99aa9a4a3ce60048ac98db048619aa525bad94c5cd5a39aadd719b4404827d53","observation_id":"df0caddc-0ea6-49f8-8c9c-80b35a7704a1","resolution":{"observed_at":"2026-08-10T04:39:03.577579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.582193Z","title":"Scaling generalist data- analytic agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.582193Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:8f491ab4a6416ce7afff3ee0cbeba8d38d331e66d8a5323f54df9dc13ad069a1","observation_id":"38312006-f686-462e-ae24-0e77b00ab9de","resolution":{"observed_at":"2026-08-10T04:39:03.582193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.460895Z","title":"Accessed: 2026-05-06","venue":null,"work_id":"0f318399-8f59-45a3-9ed0-f14257f01721","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.586686Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:1bba7b894581d23be9b6ca707969e012642fc6ecd5e31b4f3c2b4e63aca5ccb8","observation_id":"c8b03bf1-d1ee-4461-a21f-d5d7b661b266","resolution":{"observed_at":"2026-08-10T04:39:04.465596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-10T04:39:03.591340Z","title":"Self-refine: Iterative refinement with self-feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.591340Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:9211fbf014e6ac5dc99860c50135c90f120e6e4863029fccf527b310c9fa8dea","observation_id":"e7de4fcd-e169-406b-91ea-3254483e4b57","resolution":{"observed_at":"2026-08-10T04:39:03.591340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.445605Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in neural informa- tion processing systems, 36:8634–8652, 2023","venue":null,"work_id":"a2097fe3-32b4-4a9c-9271-6ee7fc7d1472","year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.596337Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:205149ec287e6d9d5c01d00136a48db3219a6c3c3a1c828eb4470b20d9f460b3","observation_id":"c44e2879-0050-436a-96b8-0081c40c9409","resolution":{"observed_at":"2026-08-10T04:39:04.450651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-10T04:39:03.600566Z","title":"Voyager: An open-ended embodied agent with large language models.arXiv preprint arXiv:2305.16291, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.600566Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:5f89c82ea6bc502c281950899f0cc33a61f90d2f8bb94a63555b7ec17ba46996","observation_id":"d7ab10fe-dee9-4e4b-be02-276bb43b150b","resolution":{"observed_at":"2026-08-10T04:39:03.600566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.429693Z","title":"Swe-agent: Agent-computer interfaces enable automated soft- ware engineering.Advances in Neural Information Processing Systems, 37:50528–50652, 2024","venue":null,"work_id":"ea6f5e4d-1bc6-4060-bc81-dbbfee3cd07b","year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.605328Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:83af2bfbbe109cc14fc0068f33bf8f4f255557365569d4ad9d17698a8c6b4e0f","observation_id":"c65ef131-db0a-42f3-ae75-2e46db8a5d69","resolution":{"observed_at":"2026-08-10T04:39:04.434898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T04:39:03.609725Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.609725Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a08c63ccb71221f903421ef88a8120ac5b3c49e8a6b901a0b9dcec25ff118a9d","observation_id":"000e14c4-7303-4d23-bcd9-1596e22aecd7","resolution":{"observed_at":"2026-08-10T04:39:03.609725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.614383Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.614383Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:abcba00e3f2f5dd88ad86ddfc3f7f2e1dd2899e552057757a4e314b9d0d4a095","observation_id":"c488ede0-f512-4ae6-9050-0a36aa648941","resolution":{"observed_at":"2026-08-10T04:39:03.614383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.618872Z","title":"Direct preference optimization: Your language model is secretly a reward model.Advances in neural information processing systems, 36:53728–53741, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.618872Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:73b3a12c14a1927e7011bc56e3c150bf2fe7f36b6d56466dd9724b38c9bb0685","observation_id":"aaa26ca6-40be-4162-acf0-908c80fce4d3","resolution":{"observed_at":"2026-08-10T04:39:03.618872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-10T04:39:03.623408Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.623408Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:f171e6a31520227856003807c426d7f8819cee4439123e5aafbf4a14e34b2f39","observation_id":"ba795ca9-c6bf-41fb-af74-c838cfb26782","resolution":{"observed_at":"2026-08-10T04:39:03.623408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-10T04:39:03.628209Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.628209Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:278d03a2bf09df21f01f64a7181c14c5fd3a68439201aeed22b5f263f771bf89","observation_id":"53f52013-4298-4d13-9832-06e4463ba865","resolution":{"observed_at":"2026-08-10T04:39:03.628209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-08-11T03:04:58.028847Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-10T04:39:03.633077Z","title":"Torl: Scaling tool-integrated rl.arXiv preprint arXiv:2503.23383, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.633077Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4c06ac816ef1e2c1ee8746526aee0b3bfaf158cef61048781a5edde4364154b7","observation_id":"3c61b79c-030c-42a0-88ff-cbac19d0b4fb","resolution":{"observed_at":"2026-08-10T04:39:03.633077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-08-10T04:39:03.637815Z","title":"Retool: Reinforcement learning for strategic tool use in llms.arXiv preprint arXiv:2504.11536, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.637815Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4a5ffd2fa1e9d45f8bfec30e1bda49e6b7151675d71cdf6117eb39c9dc106c33","observation_id":"e6ce7ab3-ca53-44a0-960d-951f42109cd4","resolution":{"observed_at":"2026-08-10T04:39:03.637815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-10T04:39:03.642514Z","title":"Toolrl: Reward is all tool learning needs.arXiv preprint arXiv:2504.13958, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.642514Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:96ce94317d2a6e092848330640e643a175069bbae52bbc7f5ed7a6151e937e59","observation_id":"3a6b4ba9-845b-4056-be59-28eb4a5da243","resolution":{"observed_at":"2026-08-10T04:39:03.642514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11425","last_updated":"2025-06-20T23:32:06Z","snapshot_observed_at":"2026-08-10T01:18:20.076393Z","submitted_at":"2025-06-13T02:46:53Z","title":"Agent-RLVR: Training Software Engineering Agents via Guidance and Environment Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11425","snapshot_observed_at":"2026-08-10T04:39:03.647525Z","title":"Agent- rlvr: Training software engineering agents via guidance and environment rewards.arXiv preprint arXiv:2506.11425, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.647525Z"},"links":{"cited_paper":"/paper/2506.11425","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:e4c38b1cad8e0f0082380b732deeec3bc6b7e3cf6121da18b56e750b8ade160d","observation_id":"ca4ee6f6-5d92-472b-95e6-2c5810b604f1","resolution":{"observed_at":"2026-08-10T04:39:03.647525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.394957Z","title":"Effects of cognitive behavioral therapy and cash transfers on older persons living alone in india: a randomized trial.Annals of internal medicine, 176(5):632–641, 2023","venue":null,"work_id":"d8df34d3-d964-4034-8f1e-e7694973ef35","year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.652822Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:89d301b2b49911cc2b5f011377a5bb314eee15ed12fa9123d61189115608f6d5","observation_id":"65e2fbaa-1e39-42b7-8721-101cae37630c","resolution":{"observed_at":"2026-08-10T04:39:04.399794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.379725Z","title":"Genomic characterization of metastatic patterns from prospective clinical sequenc- ing of 25,000 patients.Cell, 185(3):563–575, 2022","venue":null,"work_id":"3de8aec1-8a72-4911-bc3f-413c2e6fc5ae","year":2022},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.657534Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:6dff506692fa8e9a8f46af93b9159fe3156e85c156cd291f9766ce1055d5ab3e","observation_id":"5b30023b-5725-4082-80ba-ac74832d7b4f","resolution":{"observed_at":"2026-08-10T04:39:04.384842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.364517Z","title":"The support prognostic model: Objective estimates of survival for seriously ill hospitalized adults.Annals of internal medicine, 122(3):191–203, 1995","venue":null,"work_id":"785e5ebd-e657-4609-b73e-9565bd601aec","year":1995},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.662098Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:7483eb8fc7825c0c94977ce647539c4dea541299b472e0066f9d1ce84cf69034","observation_id":"5254a881-e8a1-488e-9cd5-2826d602f635","resolution":{"observed_at":"2026-08-10T04:39:04.369442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-10T04:39:03.667845Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.667845Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:be8ffee211581be279a30619eacee664ed0b85de3e5de4c9bc3cd001db267224","observation_id":"f15cf1cd-b341-43da-b393-5e0ccc2186a6","resolution":{"observed_at":"2026-08-10T04:39:03.667845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.348350Z","title":"claim”: “drug improves patient outcome","venue":null,"work_id":"47df8088-c380-4fca-8730-57c147441231","year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.672908Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:c8bbc8458c60c4f9cac7b24632b44daced33a0838b9ad68fdd948e3cdd4506cd","observation_id":"8c18f6e8-df20-41d5-b0d1-6c30635501c6","resolution":{"observed_at":"2026-08-10T04:39:04.353710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.332181Z","title":null,"venue":null,"work_id":"dc247a35-8e12-45e4-88c5-dc3e5c6bcddc","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.678589Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:77708ec4935ef68470218694e4c229e24811ad36d7d30e27aee569b176ae1cda","observation_id":"adbe0b92-7e51-427f-8525-b05ec970620f","resolution":{"observed_at":"2026-08-10T04:39:04.336736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.317398Z","title":null,"venue":null,"work_id":"19358603-bf3e-4a28-9937-6b397ba6dd5b","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.683802Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:b6fa264d2ffcc801226e26a5c1968beb3af07b21defd3c997751383d1c9e958b","observation_id":"ddf3d3cd-3bf0-42c1-b65d-4b12483816bc","resolution":{"observed_at":"2026-08-10T04:39:04.322049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.301738Z","title":null,"venue":null,"work_id":"f09b6cea-0284-4007-b11f-bc20fe63c508","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.688424Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:5d31d70cd34145a2809fab7438de16977687f61437848cf94573ddc7e7dc2014","observation_id":"93bd0286-2b0f-47e0-8e6b-13789a89d806","resolution":{"observed_at":"2026-08-10T04:39:04.306832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.285042Z","title":null,"venue":null,"work_id":"3399728e-7f1a-43b8-b627-00783188269f","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.692877Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:350b91714873607e3e50c15d1c322e121932037815f718597ff99cf7eb0fbae1","observation_id":"507ce3fc-5327-40f6-b266-2abf02d2f7e1","resolution":{"observed_at":"2026-08-10T04:39:04.290784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.560376Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.560376Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:c39c404bd105f400923da49658fdd6aa632dad24555b378bc5b959eb9e87acc1","observation_id":"163b0ec8-d481-4081-8989-a5e184270d91","resolution":{"observed_at":"2026-08-10T04:39:03.560376Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-11T09:12:11.928808Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":39,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2608.07437."}