{"as_of":"2026-08-23T14:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9801fcd4edf15705a6f0ac6b651182452a82ccfb80e53dd7317f8ccfe8071f71","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T09:13:20.071265Z","state":"measured"},{"denominator":99,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":99,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T01:31:03.738527Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-15T01:33:27.320612Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"cited_work":{"arxiv_id":"2604.24198","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.24198","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","venue":"cs.CL","work_id":"53680092-c917-4eff-9e08-5f9e6f691350","year":2026},"citing_paper":{"arxiv_id":"2605.14465","last_updated":"2026-05-14T07:00:26Z","snapshot_observed_at":"2026-08-12T20:06:21.216033Z","submitted_at":"2026-05-14T07:00:26Z","title":"From Table to Cell: Attention for Better Reasoning with TABALIGN","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T01:31:03.738527Z"},"links":{"cited_paper":"/paper/2604.24198","citing_paper":"/paper/2605.14465"},"observation_digest":"sha256:55f874fcbbe356eae0527b8d44620885a90d6f2e068797d43da188481a5429ab","observation_id":"1f515c5c-36f9-40c2-b27e-71015d3290df","resolution":{"observed_at":"2026-05-15T01:33:27.322292Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.24198/citation-record","integrity":"/paper/2604.24198/integrity","json":"/paper/2604.24198/citation-record.json","paper":"/paper/2604.24198"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.07421","doi":"10.48550/arxiv.2504.07421","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentada: Skill-adaptive data analytics for tailored insight discovery,","venue":"ArXiv.org","work_id":"4d22af57-dbf9-4eed-ab44-afc12c15b7aa","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:a482820c2782f09b87cca70b6b0c20cea7a344bdf88e09217e87090726763d2c","observation_id":"04221efb-5823-40a6-ac9b-06686a1509a9","resolution":{"observed_at":"2026-07-01T09:15:43.472687Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02766","last_updated":"2026-03-03T09:07:22Z","snapshot_observed_at":"2026-08-15T16:32:40.226808Z","submitted_at":"2026-03-03T09:07:22Z","title":"EvoSkill: Automated Skill Discovery for Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":"2603.02766","doi":"10.48550/arxiv.2603.02766","metadata_source":"pith","pith_arxiv_id":"2603.02766","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EvoSkill: Automated Skill Discovery for Multi-Agent Systems","venue":"cs.AI","work_id":"94c2c7b2-0c94-4b32-90cc-bc154d192850","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2603.02766","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:e9cb0c6f69b97753cd4ae2246bab4868e662bce58fd3d506483959fd3a586c2f","observation_id":"a4c258f2-9c22-4818-a4c0-450d4166aa24","resolution":{"observed_at":"2026-07-01T09:15:42.534852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:65fd88b502147d289559949e10019f60cec82020e3b1303b089a8cdf00f3f0f9","observation_id":"ca99bf98-9267-4d83-ba65-92584c4ca17e","resolution":{"observed_at":"2026-07-01T09:15:42.516344Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.15277","doi":"10.48550/arxiv.2505.15277","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2505.15277 , year=","venue":"ArXiv.org","work_id":"e1dbb1ed-642c-465a-8925-3ec293642847","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:31b6fde2ff354a6f9887635ad23d109ef28c1c09e92f09fc51724a2623ef4ac6","observation_id":"2b300862-21fc-4fb9-8244-2e13b2c5b539","resolution":{"observed_at":"2026-07-01T09:15:42.528914Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05241","last_updated":"2025-07-08T15:54:19Z","snapshot_observed_at":"2026-08-14T22:05:38.020325Z","submitted_at":"2025-07-07T17:50:52Z","title":"SciMaster: Towards General-Purpose Scientific AI Agents, Part I. X-Master as Foundation: Can We Lead on Humanity's Last Exam?","version":2},"cited_work":{"arxiv_id":"2507.05241","doi":"10.48550/arxiv.2507.05241","metadata_source":"pith","pith_arxiv_id":"2507.05241","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.AI","work_id":"dce7bd30-b9b3-415d-a950-0f0078ed7327","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2507.05241","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:efb463867cba3183a67b5c5eef2908f2a27f55690c1779c77d16e5e8f417f6da","observation_id":"9e80571b-8446-4f30-83e7-a8d00b871f21","resolution":{"observed_at":"2026-07-01T09:15:42.581077Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:29.212628+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:29.212628+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.17260","doi":"10.48550/arxiv.2512.17260","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seed-prover 1.5: Mastering undergraduate-level theorem proving via learning from experience","venue":"arXiv (Cornell University)","work_id":"06a2ed7e-52e1-4927-ba09-545d2843a7f4","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:3d6b34db7e119ce88fb620b3d0f816fb30720f4dab9607669409c8ad4e4641e6","observation_id":"1e9fc329-0652-49ec-9358-1e5fabf1c507","resolution":{"observed_at":"2026-07-01T09:15:43.485910Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.060249Z","title":null,"venue":null,"work_id":"133cec36-91c6-47c0-85d5-063481ac620d","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:40fa64de160f4bc6dadf6e1f59252f243b7d4b42cb4485725cc133344a43713e","observation_id":"632ea8bd-29c8-49ac-97e7-4008e83f0c07","resolution":{"observed_at":"2026-07-06T11:52:23.061398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":"2503.09567","doi":"10.48550/arxiv.2503.09567","metadata_source":"pith","pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-07-10T18:57:31.639044Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","venue":"cs.AI","work_id":"0b361fed-cf2a-4b90-b61a-de88de4b8840","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:5e9a754592110f667203e0a5be7be6bf78808f722a9d805cb4c74dcfdefea5a3","observation_id":"167e743e-6fdf-4bc1-b320-cd0bdc9c06c0","resolution":{"observed_at":"2026-07-01T09:15:42.723416Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:19.477611+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:19.477611+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01903","last_updated":"2025-08-05T16:19:40Z","snapshot_observed_at":"2026-08-17T12:02:55.678391Z","submitted_at":"2025-07-02T17:19:20Z","title":"AI4Research: A Survey of Artificial Intelligence for Scientific Research","version":2},"cited_work":{"arxiv_id":"2507.01903","doi":"10.48550/arxiv.2507.01903","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01903","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI4Research","venue":"ArXiv.org","work_id":"8434d9d4-cce5-4158-b4f0-acc351e5bb4c","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2507.01903","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:9fd87baad99079cf5b1c96b971fd29445ab3c8e86be575bdebc4606a994d6679","observation_id":"88d72abf-3384-404e-b476-96462387ce6c","resolution":{"observed_at":"2026-07-01T09:15:42.666393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:19.926431+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:19.926431+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.041583Z","title":"Baker, Benjamin Burns, Daniel Adu-Ampratwum, Xuhui Huang, Xia Ning, Song Gao, Yu Su, and Huan Sun","venue":null,"work_id":"2573efd4-ee66-4d6a-9cbc-0a23478a29f9","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:af011a910073009c13f9a9c135d9e394b36a59c3cc45ae03e32d040b095be000","observation_id":"58c78b30-5362-4402-aff4-1ed83c6c3da8","resolution":{"observed_at":"2026-07-06T11:52:23.043057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-20T04:08:34.710482Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":"2502.01456","doi":"10.48550/arxiv.2502.01456","metadata_source":"pith","pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Process Reinforcement through Implicit Rewards","venue":"cs.LG","work_id":"c31a2126-86f9-44f3-91f3-208d0fc1463a","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:fb9b2181e6700cb63259be56dfaa8eaca264f57bbc061c90bb4a68bd0255edee","observation_id":"de051dd9-7b10-40aa-a562-6eb6a2dd5cf6","resolution":{"observed_at":"2026-07-01T09:15:43.532637Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-07T20:38:24.357487+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T20:38:24.357487+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-08-17T01:58:07.850738Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":"2512.02556","doi":"10.18653/v1/d18-1512","metadata_source":"pith","pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","venue":"cs.CL","work_id":"07c85cc5-4086-4abc-823b-6d0f4ff784d0","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:bd2644443436797ee8eb049c5bd019b7e4351147a62e8c1243b0ac0de8ecffd0","observation_id":"0d6bb89a-1590-4031-bd7a-ef1e53a7fcfa","resolution":{"observed_at":"2026-07-01T09:15:42.754077Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.22543","doi":"10.48550/arxiv.2510.22543","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fapo: flawed-aware policy optimization for efficient and reliable reasoning.arXiv preprint arXiv:2510.22543, 2025","venue":"Open MIND","work_id":"f2f9f31e-a167-4a8d-8ce9-010f41b124b6","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:6123a7a021ece7ea6d2766e28ae5b50903a4a55e68708702dd1bb88097afa695","observation_id":"b4b8a05e-b80a-47b5-808c-bfb78a872248","resolution":{"observed_at":"2026-07-01T09:15:42.512191Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":"2504.11536","doi":"10.48550/arxiv.2504.11536","metadata_source":"pith","pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","venue":"cs.CL","work_id":"6da510e4-e55c-4412-b7c8-839984508e99","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:992c46fe39890736e22684220277dde996deda195f4d32e07f064fa3bb841d46","observation_id":"cc6d35dd-12d6-43cc-b596-4dbad5863ca8","resolution":{"observed_at":"2026-07-01T09:15:42.708792Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.02360","doi":"10.48550/arxiv.2509.02360","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When agents go astray: Course-correcting swe agents with prms","venue":"ArXiv.org","work_id":"43e768f1-21c5-42f2-a4a8-93e70c8576d2","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:50f56e5c61501d480a49e2dcf8cc47f944366af1e34d9343d97b0527898a5c16","observation_id":"1db18f53-3398-42d7-af9a-c5717a01dcdc","resolution":{"observed_at":"2026-07-01T09:15:42.572980Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-10T19:38:15.086143+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T19:38:15.086143+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11504","last_updated":"2024-11-18T12:04:52Z","snapshot_observed_at":"2026-08-19T02:03:59.847880Z","submitted_at":"2024-11-18T12:04:52Z","title":"Search, Verify and Feedback: Towards Next Generation Post-training Paradigm of Foundation Models via Verifier Engineering","version":1},"cited_work":{"arxiv_id":"2411.11504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.11504","snapshot_observed_at":"2026-07-01T09:15:43.495053Z","title":"Search, verify and feedback: Towards next generation post- training paradigm of foundation models via verifier engineering","venue":null,"work_id":"85db5870-c8dc-4791-b88c-c74413599d40","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2411.11504","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:8fd63d74e62f7046a1c9e5fa0cf17a28b5e2598d4113b5d49c6169b082f99c78","observation_id":"5f751d25-fe37-4468-b4c9-1bb9bc2be9d6","resolution":{"observed_at":"2026-07-01T09:15:43.498711Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.054211Z","title":null,"venue":null,"work_id":"4a51a7d0-9cd1-4940-84c7-62f63ecd2621","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:b5e208ac07b6d7ef2bd789b51200a2168be4223384a618fee4605b3112911002","observation_id":"29b0c001-ade0-4254-b0dc-c1717fdacd20","resolution":{"observed_at":"2026-07-06T11:52:23.055602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.035719Z","title":null,"venue":null,"work_id":"5707ace8-eca8-4d28-9c36-fd8d5c547021","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:f6ab2e905acc6497c46309cc33b1fcf24bf122a183687f4b1d585e6bbc255883","observation_id":"ebed5867-e908-4387-a68c-e93145edd1a7","resolution":{"observed_at":"2026-07-06T11:52:23.037072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.066410Z","title":null,"venue":null,"work_id":"69473a4a-339d-4cd0-8ebe-6079393e273b","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:75a0664163aacd54dfcfcb1c339a595e12486d1433b737abcceea049bb79e730","observation_id":"d8847d2e-2332-4d5f-ba21-9f30ce13de62","resolution":{"observed_at":"2026-07-06T11:52:23.067458Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.16828","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:40:07.881388Z","title":"Process reward models that think","venue":null,"work_id":"5eb327be-4cef-462e-8ccc-1fafa6d30e28","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:fc58a50c2435ada7188be357b21fe815aae8e3c657dd1738a4ae901960174bf8","observation_id":"45978254-4fc1-4529-a623-ee5a6d5ac4d4","resolution":{"observed_at":"2026-07-01T09:15:43.506903Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.12294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:18:22.406574Z","title":"ToolPRMBench: Evaluating and advancing process reward models for tool-using agents.arXiv preprint arXiv:2601.12294, 2026","venue":null,"work_id":"ed14a424-cb07-4cb1-a720-71889f4e3a1a","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:0f02c3da52923ccda25f15feac72b955a4fd5bcc67ac5f2cd2748aed3b75e906","observation_id":"536b63fb-9b77-44bf-9326-2554433ed828","resolution":{"observed_at":"2026-07-01T09:15:43.479454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.051871Z","title":null,"venue":null,"work_id":"0831a951-aef2-43ca-a24f-2608214f9e80","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:9f962f9a40dbf3d3e9fa64503d330fd3407aa750fbc27f986e641fdb318b1a0d","observation_id":"aeb8dd15-f250-4183-812b-446367310ee5","resolution":{"observed_at":"2026-07-06T11:52:23.053112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08140","last_updated":"2025-06-09T18:41:50Z","snapshot_observed_at":"2026-08-14T05:16:32.953394Z","submitted_at":"2025-06-09T18:41:50Z","title":"AutoSDT: Scaling Data-Driven Discovery Tasks Toward Open Co-Scientists","version":1},"cited_work":{"arxiv_id":"2506.08140","doi":"10.48550/arxiv.2506.08140","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08140","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autosdt: Scaling data-driven discovery tasks toward open co-scientists","venue":"ArXiv.org","work_id":"1434efbd-7498-4c74-9421-4fe06d84b2b2","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2506.08140","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:b201f938371d2dd9fcedae45cd87f463605363388a845903548823b3c33c77b4","observation_id":"8f4f06cf-fbf0-4e17-8c8e-9a6a6844f1da","resolution":{"observed_at":"2026-07-01T09:15:42.713304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.056273Z","title":"Pan, Guilin Qi, Haofen Wang, and Huajun Chen","venue":null,"work_id":"474de767-439a-4c71-8e2b-0428f0c438ce","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:8d75b9856431bd057d0cbbd2bdc4ab0ac0ad160523e681287aa2eaf24977a0d0","observation_id":"3cb5b5c3-a91e-459e-829b-6ecfaf4c006b","resolution":{"observed_at":"2026-07-06T11:52:23.057476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04448","last_updated":"2026-08-19T17:52:04Z","snapshot_observed_at":"2026-08-22T23:11:44.591494Z","submitted_at":"2026-02-26T14:24:02Z","title":"SkillNet: Create, Evaluate, and Connect AI Skills","version":2},"cited_work":{"arxiv_id":"2603.04448","doi":"10.48550/arxiv.2603.04448","metadata_source":"arxiv_reference","pith_arxiv_id":"2603.04448","snapshot_observed_at":"2026-08-20T02:23:33.197848Z","title":"Available: https://arxiv.org/abs/2603.04448","venue":"Open MIND","work_id":"47ef6124-7b5c-4acd-94d6-cbd6ab854c9c","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2603.04448","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:5535f503f1f75bd8d4821ab459547b00386a10ee503ab4235fcf2eea661cdbbb","observation_id":"680b7df3-45be-4e58-9520-5e14fc41cbf8","resolution":{"observed_at":"2026-08-20T02:23:33.197848Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.078337Z","title":null,"venue":null,"work_id":"6aaff641-9ad3-4227-99b4-67fec1393f12","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:dedaa90af126fcadd894973e2fe9e7db3b0ecbb0ef018769b36fc7bf4bbd0151","observation_id":"871796f6-94c6-44d5-ba49-41c3e4c5b55c","resolution":{"observed_at":"2026-07-06T11:52:23.079475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-08-13T13:25:07.876055Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"cited_work":{"arxiv_id":"2510.14703","doi":"10.48550/arxiv.2510.14703","metadata_source":"pith","pith_arxiv_id":"2510.14703","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","venue":"cs.AI","work_id":"473b0276-af7f-41e0-8683-212f4d7ddff0","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2510.14703","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:ee6f133acfad6465efdc6bba7810b4ebeef1a0b10a1ee0438ebced59f1f958a7","observation_id":"57300735-99e4-4ec8-b789-8bae6a35cfa7","resolution":{"observed_at":"2026-07-01T09:15:42.750478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-18T20:31:50.522103Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":"2502.06703","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-07-04T21:00:08.398075Z","title":"Liu, R., Gao, J., Zhao, J., Zhang, K., Li, X., Qi, B., Ouyang, W., and Zhou, B","venue":null,"work_id":"9325fd2c-00cc-47d0-9154-bfa2a83c5179","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:3489b0cb10b38de9e311d8262a57ad7e03155df18a0a0b18e02c9ce336f3b0e1","observation_id":"3b38060d-072b-466c-b341-4eeb9f518978","resolution":{"observed_at":"2026-07-01T09:15:43.492180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.048025Z","title":null,"venue":null,"work_id":"81390253-d4ea-4310-9d16-fb2a54ca0bfd","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:d197536c369a3b0e7c96cb8a739c3b05847e1b0005ad299e13075682f7d9bef8","observation_id":"5e22b3f6-27c3-4386-bd33-e9534df24371","resolution":{"observed_at":"2026-07-06T11:52:23.049164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02039","last_updated":"2026-05-15T21:30:23Z","snapshot_observed_at":"2026-08-15T09:59:12.919443Z","submitted_at":"2026-02-02T12:36:57Z","title":"Hunt Instead of Wait: Evaluating Deep Data Research on Large Language Models","version":2},"cited_work":{"arxiv_id":"2602.02039","doi":"10.48550/arxiv.2602.02039","metadata_source":"pith","pith_arxiv_id":"2602.02039","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunt Instead of Wait: Evaluating Deep Data Research on Large Language Models","venue":"cs.AI","work_id":"4338d3e8-b989-4e4e-a51c-ba90e6ec89d0","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2602.02039","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:4b414e5f30b6880608d34b66939f72512020ba8a4b550ab61c22b4157bcad292","observation_id":"68e58845-f2b2-4802-98ae-12ea66279c77","resolution":{"observed_at":"2026-07-01T09:15:43.537267Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19199","doi":"10.48550/arxiv.2509.19199","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentic reinforcement learning with implicit step rewards","venue":"ArXiv.org","work_id":"6eb5e259-3013-4695-8aa8-ec5df9a9d481","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:327fc35305a09c6919597fa8930522c356cd76f475b5103c3bb222072de6db6a","observation_id":"739956c8-f5c8-44c1-82c1-7745c66a4774","resolution":{"observed_at":"2026-07-01T09:15:42.594739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":"2406.06592","doi":"10.48550/arxiv.2406.06592","metadata_source":"pith","pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","venue":"cs.CL","work_id":"9906447b-5bb3-4367-91f9-b9d556c9ee7f","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:b0839c8a3614229e8523457bb6f45fcc74e6b66033734913b007896c4a447352","observation_id":"406fb051-072e-40bc-9079-5e1e5395904d","resolution":{"observed_at":"2026-07-01T09:15:42.628606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1794","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Robust Mathematical Reasoning","venue":null,"work_id":"da5c2222-6fc3-4c88-8175-a1b1d83743ad","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:bd85241172eb16758f060123f061e33c396a364789866dce9647ed18d0ebbf0f","observation_id":"be265101-3e63-4e4d-a8e6-64e85a450f32","resolution":{"observed_at":"2026-07-01T09:15:42.746976Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T15:23:56.464287+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T15:23:56.464287+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-demo.31","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Insightpilot: An llm-empowered automated data exploration system,","venue":null,"work_id":"759f2ae2-dd22-4e0e-8868-e4ddc132f30b","year":2023},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:3e073675ac5bbb036592e65687292805638fc040d13d2a593c2536163d993ef0","observation_id":"9fbcbca2-acb1-45f1-ba44-037e88ac5006","resolution":{"observed_at":"2026-07-01T09:15:42.519097Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.21825","doi":"10.48550/arxiv.2509.21825","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ds-star: Data science agent via iterative planning and verification","venue":"arXiv (Cornell University)","work_id":"2bcad54a-0357-499c-84e7-f2e7b104b1f1","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:0dc8b75e174a318be11d74d771458f783a8c2bdb5f14ef398f419ccf546953a9","observation_id":"9730ce43-cab5-435d-8815-b11b1e3b32b4","resolution":{"observed_at":"2026-07-01T09:15:42.568946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25158","last_updated":"2026-06-04T12:51:52Z","snapshot_observed_at":"2026-08-12T22:20:59.543657Z","submitted_at":"2026-03-26T08:26:38Z","title":"Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills","version":5},"cited_work":{"arxiv_id":"2603.25158","doi":"10.48550/arxiv.2603.25158","metadata_source":"pith","pith_arxiv_id":"2603.25158","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills","venue":"cs.AI","work_id":"c6f8f524-e13a-48b6-99b8-7dd3357d9665","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2603.25158","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:fe38cda93102dd9d8b69094f47e955b3cf6b1d1367d35902e768cb984d3604a4","observation_id":"7d89306a-b730-41bf-b74a-b088bb7d9b09","resolution":{"observed_at":"2026-07-01T09:15:42.739992Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:58.511509+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:58.511509+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.16344","doi":"10.48550/arxiv.2601.16344","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dsgym: A holistic framework for evaluating and training data science agents","venue":"arXiv (Cornell University)","work_id":"5a455d6f-ed41-4555-8be8-58e0671992ed","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:a6b2d9c6eea3515628e9af44db36747c40dd8f8013c45e8a88d44a8d528af8a3","observation_id":"060804ef-25f9-400f-a851-f0d640f71216","resolution":{"observed_at":"2026-07-01T09:15:43.543782Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21403","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T13:36:58.870646Z","title":"Datacross: A unified benchmark and agent framework for cross-modal heterogeneous data analysis,","venue":null,"work_id":"b425b987-ecd8-4638-afde-fed7be9c723d","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:df6d48d89be5c08272fd02a673ca086b594a184555a35caebf744f2fe9ba4ba6","observation_id":"249e9a29-2541-4a6b-b2e7-967ac74005c3","resolution":{"observed_at":"2026-07-01T09:15:43.525540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-08-15T04:58:53.543603Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":"2504.13958","doi":"10.48550/arxiv.2504.13958","metadata_source":"pith","pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ToolRL: Reward is All Tool Learning Needs","venue":"cs.LG","work_id":"82252022-0241-4006-9b28-fd1e69293343","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:d82ea77af1b651723cd7f4f57b9be44fdf34973fd88c52976223f9ca9e02427e","observation_id":"36e5f06e-f2b6-4886-a8a2-049aad7307dc","resolution":{"observed_at":"2026-07-01T09:15:42.719608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.045492Z","title":null,"venue":null,"work_id":"8a7dd6fe-199f-40a9-942b-a50121eec834","year":2023},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:4c1cc7204b441ea220f700d1153cf9add196d84c417e88698d5ea9d216b19b5d","observation_id":"57ada28a-5d5e-4664-ba81-170bb5138306","resolution":{"observed_at":"2026-07-06T11:52:23.047194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.049909Z","title":null,"venue":null,"work_id":"a853c055-dca8-4a98-aec4-dcf0398f14ff","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:9d6762fbe76c053ab99cbd0ba59f5e8c9eb9366e3fe57b4e537b3e5d1f649629","observation_id":"ceea8b4b-1f0d-4b28-831f-00fa6f1e2dfa","resolution":{"observed_at":"2026-07-06T11:52:23.051269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25084","doi":"10.48550/arxiv.2509.25084","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"ArXiv.org","work_id":"40e87402-4904-4cf8-a37c-9b84ba44f3ad","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:ca78f492f93d784bfceed9de46d1a586c1668cc24c3d0b55c26f36fe193f7314","observation_id":"e743c5fc-3b1c-456d-83f0-bd335222f838","resolution":{"observed_at":"2026-07-01T09:15:42.683723Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:29.658593+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:29.658593+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.03244","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:15:43.509465Z","title":null,"venue":null,"work_id":"cd400a60-92a7-4d91-8ed3-25892040210c","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:ba9efb04bb3f0247b0a37f0ea940b3d3dd6f45242babfc609c4eee91ed5a2210","observation_id":"e4ab68e8-445e-48e5-8ab6-d311e3d6fd40","resolution":{"observed_at":"2026-07-01T09:15:43.512184Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":"2504.21801","doi":"10.48550/arxiv.2504.21801","metadata_source":"pith","pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","venue":"cs.CL","work_id":"3579ad7c-ab73-41db-801b-bf86628c5c02","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:0c060d22b61f0e4417564755ee2eca09b17fdf852a4772b6c3cef32e7b5bd187","observation_id":"1d8e9d55-7fd9-402c-9a5c-20293dec0e12","resolution":{"observed_at":"2026-07-01T09:15:42.678042Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-12T04:49:13.361719+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T04:49:13.361719+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04227","last_updated":"2025-06-17T16:19:14Z","snapshot_observed_at":"2026-08-20T09:43:35.499735Z","submitted_at":"2025-01-08T01:58:42Z","title":"Agent Laboratory: Using LLM Agents as Research Assistants","version":2},"cited_work":{"arxiv_id":"2501.04227","doi":"10.48550/arxiv.2501.04227","metadata_source":"pith","pith_arxiv_id":"2501.04227","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent Laboratory: Using LLM Agents as Research Assistants","venue":"cs.HC","work_id":"cb6e0bd7-2f2d-4052-875a-985ba5600340","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2501.04227","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:f8d9545f0ab92c4fc67bd7432da14df42083b14011906ae66c208553018ce291","observation_id":"e002fea5-d400-4223-8c34-3d839ad5b539","resolution":{"observed_at":"2026-07-01T09:15:42.694366Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:20.272963+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:20.272963+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.058085Z","title":null,"venue":null,"work_id":"92d40b54-8af0-4289-8c02-3bfad9e8dd3e","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:43a4ec0fe5e8cf3918ca98ddfbca28275e94ce76fa3cb5ecf6cfc9ba29c466dc","observation_id":"0950b03a-2d39-4017-9f4d-dd953a79c38b","resolution":{"observed_at":"2026-07-06T11:52:23.059419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.22570","doi":"10.48550/arxiv.2511.22570","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepseekmath-v2: Towards self-verifiable mathematical reasoning","venue":"ArXiv.org","work_id":"b98ba1e9-8a01-4da9-b050-43dff9ef5fab","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:27e39b76fcaae60718c4395d95f917c7aadbeafbe930ff0007ec713f10f750f7","observation_id":"a39739d6-d6c2-46cf-bc7b-ddb29ccff3e0","resolution":{"observed_at":"2026-07-01T09:15:42.701067Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:b9df83d12cd880dc01eaa9ba5ab72c6d1fdca680cb94c6122887cf66c8699918","observation_id":"039d2c1e-99e5-4bd4-8dd6-f1ab7fce99ea","resolution":{"observed_at":"2026-07-01T09:15:42.757805Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9031.369607","doi":"10.1145/3689031.3696072","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":"4909736c-3fe1-4820-b489-cca51669c6d2","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:33ef1c96350d7663990e884612294cd635d8ee3c9b3e1c15a1fa8d819a511a82","observation_id":"75263ab1-b70c-4e1e-8407-9e3a8f58aca5","resolution":{"observed_at":"2026-07-01T09:15:42.647142Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:fa205bef93575d101a8a62aaad9aec50e49a70845f4aa604c1ff08ff30916837","observation_id":"2e307484-7f7a-40ce-867f-5a78bb24adcf","resolution":{"observed_at":"2026-07-01T09:15:42.652362Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05002","last_updated":"2026-07-16T09:43:14Z","snapshot_observed_at":"2026-08-21T21:51:43.298528Z","submitted_at":"2025-08-07T03:33:59Z","title":"AgenticData: An Agentic Data Analytics System for Heterogeneous Data","version":2},"cited_work":{"arxiv_id":"2508.05002","doi":"10.48550/arxiv.2508.05002","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.05002","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agenticdata: An agentic data analytics system for heterogeneous data,","venue":"arXiv (Cornell University)","work_id":"30c36747-d1cb-4300-8f38-0ba777404868","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2508.05002","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:3c042a484ea8f0ad114bdd5992d82d56a958ee2e0f9a3e2af8ecf4d582a72347","observation_id":"9821ef54-ff80-4460-93c4-1f828fcd5ba6","resolution":{"observed_at":"2026-07-17T01:20:37.666847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.064567Z","title":null,"venue":null,"work_id":"5e3cc0a6-01d2-4c84-a8c3-2e21b7e31b37","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:59c7dbbd33681c7c06c9a963fee30b786957893ca5cf3ae86671363c369eb9a6","observation_id":"d0bd99ce-3e56-44f7-97ce-d194dc776e5b","resolution":{"observed_at":"2026-07-06T11:52:23.065794Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.510","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T13:36:58.254898Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","venue":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"85cb163c-682e-453b-a6a0-83882efc0942","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:03e5da7e70492c77c00c4371ce30f9e564d34e625889be314cf6d16cbc8c98ad","observation_id":"5756367a-ff06-4a04-a31c-00ae903f635f","resolution":{"observed_at":"2026-07-01T09:15:42.760850Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:52:29.842744+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:52:29.842744+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.02744","doi":"10.48550/arxiv.2508.02744","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language model-based data science agent: A survey","venue":"arXiv (Cornell University)","work_id":"cc2b1378-83aa-4279-8bb8-e180797c1f10","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:ba1b316819ec4d45aa0509d0579f052a450211520140817fc7fac6a27a775205","observation_id":"1e16ea8c-ab00-401a-88ba-ba298b405165","resolution":{"observed_at":"2026-07-01T09:15:42.622993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.04888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:48:46.289819Z","title":"Smartsearch: Process reward-guided query refinement for search agents","venue":null,"work_id":"8589eb76-21b9-4339-9039-250a8d3b4d5e","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:0f3fc170ab080f7b39c754091e3f735aab3e6202ca18352a032eec591f4eb0dc","observation_id":"63a72749-a364-4bd9-b5a4-d38d48ee8436","resolution":{"observed_at":"2026-07-01T09:15:43.549075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i24.34739","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tablebench: a comprehensive and complex benchmark for table question answering","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"ce777d2b-b6b6-4e6d-9222-ac8b7d50741b","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:bdac29585e2a3dd457e4c6277db0324231379c2c0aafdb5d74256c59bd96689e","observation_id":"0b6cbba3-a225-4523-9ace-65b8c110f1fb","resolution":{"observed_at":"2026-07-01T09:15:42.575932Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.08325","doi":"10.48550/arxiv.2511.08325","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Agentprm: Process reward models for llm agents via step-wise promise and progress","venue":null,"work_id":"f0a63f5a-bc9c-4e6b-947c-842596051b3f","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:3e151f75bff97e66fa929ff81399e96c33fe0f1c2ea3fdbb2ec0b5515536cee7","observation_id":"5c3ebbb0-3d3f-4a0b-83fb-db82db24e525","resolution":{"observed_at":"2026-07-01T09:15:42.589769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13269","last_updated":"2025-04-01T12:13:46Z","snapshot_observed_at":"2026-08-20T20:13:27.032215Z","submitted_at":"2025-03-17T15:22:19Z","title":"DAgent: A Relational Database-Driven Data Analysis Report Generation Agent","version":2},"cited_work":{"arxiv_id":"2503.13269","doi":"10.48550/arxiv.2503.13269","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.13269","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dagent: A relational database-driven data analysis report generation agent,","venue":"ArXiv.org","work_id":"84ab8d98-3128-4418-a587-a693060e836c","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2503.13269","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:38be8e52832d93af676604cd94b110d8498671e5a35a807d2676e5a7dab9fd7d","observation_id":"f4bb0a2b-f177-4c3a-8229-8ada4b1d931b","resolution":{"observed_at":"2026-07-01T09:15:42.564141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:6ed31694662012ed125c0e37e1dec935c85fecbbab051480042ba9959f987a0f","observation_id":"7fbeaf8b-0a38-4630-b2c9-a4327faffc4e","resolution":{"observed_at":"2026-07-01T09:15:42.617087Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.701","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Matplotagent: Method and evaluation for llm-based agentic scientific data visualization","venue":null,"work_id":"ea894a30-5209-441b-9e1f-2910fc84f09f","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:83eebaf704e50954faca4d71fb4b7b729bb40127f2266238e5353270e6469dca","observation_id":"40bbb88e-7111-4730-b08b-f608d164b66f","resolution":{"observed_at":"2026-07-01T09:15:42.601822Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T01:54:26.520342Z","title":"Narasimhan, and Yuan Cao","venue":null,"work_id":"d3fc0192-7b7f-456e-a718-faf3289712c6","year":2023},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:2af3e47a8ebec48d58c30ab819a6d2de1730255a6ecc1471a40052a09b85becb","observation_id":"6882a4b0-ab4b-46a4-a60f-584796228353","resolution":{"observed_at":"2026-07-06T11:52:23.077646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.07044","doi":"10.48550/arxiv.2503.07044","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datawiseagent: A notebook-centric llm agent framework for adaptive and robust data science automation, 2025","venue":"ArXiv.org","work_id":"66fe5dc2-7450-496e-a6fe-12e4515ae4f9","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:3856c3469679b060c9442755e8d5e6d87d713f9f0512329f4c85af1bdedbe16b","observation_id":"0346075b-6d70-43fa-a58c-d7813585ebc8","resolution":{"observed_at":"2026-07-01T09:15:42.640522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-18T05:01:20.543826Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:a7cead68e305479460bf658e74768fdae0a6eac4df2a7a7ca36a7eb89cceb1fb","observation_id":"d06995e0-ffee-4da7-a255-7bdbecd0835a","resolution":{"observed_at":"2026-07-01T09:15:42.545950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14987","last_updated":"2022-03-28T18:00:51Z","snapshot_observed_at":"2026-07-06T12:53:50.496350Z","submitted_at":"2022-03-28T18:00:51Z","title":"Multilingual Knowledge Graph Completion with Self-Supervised Adaptive Graph Alignment","version":1},"cited_work":{"arxiv_id":"2203.14987","doi":"10.48550/arxiv","metadata_source":"doi_reference","pith_arxiv_id":"2203.14987","snapshot_observed_at":"2026-07-09T21:46:34.506658Z","title":"Dickerson","venue":"cs.AI","work_id":"5c2060c6-427c-4321-be22-49ccae439d80","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2203.14987","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:7b25a4aed65f09aaca4c0422f74a24cb527bf3a232f9e1f10d88732d4aa9862c","observation_id":"950d63a7-e216-4129-83c7-b56c7987b6c2","resolution":{"observed_at":"2026-07-01T09:15:42.597957Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.071947Z","title":null,"venue":null,"work_id":"e5db9c84-f039-4096-b477-2cf16a488ba6","year":2024},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:903180391776df48dcc49794c15edd9e78357c1b6b4fed043ca090a943452f5e","observation_id":"4038613c-561c-4357-8e8e-3ea4ff831abf","resolution":{"observed_at":"2026-07-06T11:52:23.073560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.067988Z","title":null,"venue":null,"work_id":"0c2f4f30-e0c6-4c9f-8214-8ba38579e451","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:95c5c4072f7939a5ddbce76648eaf31ae234ff6a7fb1a2ac214233f254cac52e","observation_id":"0c8e829f-d263-459c-8456-1a57f276ee8a","resolution":{"observed_at":"2026-07-06T11:52:23.069295Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.22249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:15:43.463325Z","title":"Funprm: Function-as-step process reward model with meta reward correction for code generation","venue":null,"work_id":"88294571-29d6-494f-b0e9-ff48d72e2a45","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:c0f55845caa3138fa319a93275ef132d0512bc6c73c48174d8c78f627456bf85","observation_id":"6492ac67-5984-4838-b836-64f2a497a177","resolution":{"observed_at":"2026-07-01T09:15:43.467126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.16872","doi":"10.48550/arxiv.2510.16872","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2510.16872 , year=","venue":"ArXiv.org","work_id":"9bb5d26f-89e5-4305-a6ab-d40453589b67","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:775b23cc5b093832a315c1957a31abac60aaed9a08bd8c8886f0dcd08c5d63fd","observation_id":"97f51736-475a-48c9-9558-14b2f4c07eca","resolution":{"observed_at":"2026-07-01T09:15:42.744162Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.037768Z","title":null,"venue":null,"work_id":"e810b78b-dfd9-4863-9e1d-22ea1f7b53f2","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:97fb78b5d18605a45becf6d99d4b53c93fed10fd298f382b62f5cf39bb59cc53","observation_id":"c2118154-7fed-49cf-a0ab-69655148297f","resolution":{"observed_at":"2026-07-06T11:52:23.038949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12752","last_updated":"2025-08-18T09:26:14Z","snapshot_observed_at":"2026-08-19T22:29:57.931613Z","submitted_at":"2025-08-18T09:26:14Z","title":"Deep Research: A Survey of Autonomous Research Agents","version":1},"cited_work":{"arxiv_id":"2508.12752","doi":"10.48550/arxiv.2508.12752","metadata_source":"pith","pith_arxiv_id":"2508.12752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deep research: A survey of autonomous research agents.arXiv preprint arXiv:2508.12752, 2025a","venue":"cs.IR","work_id":"94fabb43-10d5-4689-a4ff-8b7caab0406c","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2508.12752","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:b88ef09847e2c6026fe705db3ac44b9e8c10950ee6de747734b7539077a02149","observation_id":"ada35c39-b4ec-4ff9-b4b5-ac764dec5d7e","resolution":{"observed_at":"2026-07-01T09:15:43.520155Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07209","last_updated":"2025-05-19T09:44:19Z","snapshot_observed_at":"2026-08-16T15:24:33.071071Z","submitted_at":"2023-06-12T16:12:56Z","title":"Data-Copilot: Bridging Billions of Data and Humans with Autonomous Workflow","version":8},"cited_work":{"arxiv_id":"2306.07209","doi":"10.48550/arxiv.2306.07209","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07209","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2306.07209 , year=","venue":"arXiv (Cornell University)","work_id":"567aaa63-da15-49df-a37e-843fccb3f726","year":2023},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2306.07209","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:a0dd0f8507f828007df7191869ab7bf55a7bac7441542cb73b16b714d559ca96","observation_id":"a73f2566-3e57-42f3-8903-47580c5522f5","resolution":{"observed_at":"2026-07-01T09:15:42.541013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.04671","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:28:44.618196Z","title":"Reward- sql: Boosting text-to-sql via stepwise reasoning and process-supervised rewards","venue":null,"work_id":"1cc54366-f511-478b-b656-47d6b16f9f1f","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:8daa6285f7201b2a4b670e887a1c230700b52acb4eee1c068bdffab8b1e31c91","observation_id":"368d7af3-b2ff-49d8-a678-26f9c0049933","resolution":{"observed_at":"2026-07-01T09:15:43.459871Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.070105Z","title":null,"venue":null,"work_id":"102e4b53-2fc6-40b0-8aaf-68bf60b6733a","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:08117467205da1a99583d1a31c1c6da9422aa45003fad3bba445beb4d5344d40","observation_id":"7fbca742-558c-42a0-a846-f0446e49ee36","resolution":{"observed_at":"2026-07-06T11:52:23.071375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00891","last_updated":"2025-04-05T03:04:37Z","snapshot_observed_at":"2026-08-19T12:21:13.450899Z","submitted_at":"2025-04-01T15:21:05Z","title":"GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning","version":2},"cited_work":{"arxiv_id":"2504.00891","doi":"10.48550/arxiv.2504.00891","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00891","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2504.00891 , year=","venue":"ArXiv.org","work_id":"987b931c-ea64-480c-a5b5-e33b60f1c6b2","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2504.00891","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:f93d44d49b0f7d2c11f48c7642f698b125fbf92629cd17f58aa79d35dfcb39f8","observation_id":"55fb33bd-8353-4aa3-9d71-e11beff6a47a","resolution":{"observed_at":"2026-07-01T09:15:42.607003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i28.35383","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWIFT: A scalable lightweight infrastructure for fine-tuning","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"5b90ac60-876d-482c-871d-34bfaaef33b4","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:08d072d76325b27f65587f0650bcb9f46c665f913ad7b933464387da25115ebc","observation_id":"83494e52-02e6-4d5a-b191-1887d0b2bf9c","resolution":{"observed_at":"2026-07-01T09:15:42.611300Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08049","last_updated":"2026-04-29T02:51:24Z","snapshot_observed_at":"2026-07-06T22:32:07.945004Z","submitted_at":"2025-10-09T10:35:31Z","title":"A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models","version":3},"cited_work":{"arxiv_id":"2510.08049","doi":"10.48550/arxiv.2510.08049","metadata_source":"pith","pith_arxiv_id":"2510.08049","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models","venue":"cs.CL","work_id":"1b364adb-2d12-4e61-89fc-804d607b2735","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2510.08049","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:a3778dc1d73bd796326e0a571eb4ba428c2dc3775d3ae413dd5685ab2526515a","observation_id":"d58d4ea6-070a-4d41-826e-141868c78f62","resolution":{"observed_at":"2026-07-01T09:15:42.558536Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.029837Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":"1d05497b-8738-428f-9353-666e49be8739","year":2023},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:482a18e8f4cbbde8f557e2957bb3b4b2e1f8609a15a4ffd07306f6516abb7082","observation_id":"c0b5e993-7455-47ca-96c1-5d52ded1811c","resolution":{"observed_at":"2026-07-06T11:52:23.031405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15202","last_updated":"2026-05-04T16:17:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T03:31:11Z","title":"Fin-PRM: A Domain-Specialized Process Reward Model for Financial Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":"2508.15202","doi":"10.48550/arxiv.2508.15202","metadata_source":"pith","pith_arxiv_id":"2508.15202","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Fin-PRM: A Domain-Specialized Process Reward Model for Financial Reasoning in Large Language Models","venue":"cs.CL","work_id":"aed6d055-91a1-4b5d-997d-3b42689dc8f2","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2508.15202","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:60c0e836840d37f2aacf58a3b77fa0c6d5414c4d15febeb90bddc991187a16bd","observation_id":"803ce4e4-ea78-47c6-81d5-ef00bdd8bfa7","resolution":{"observed_at":"2026-07-01T09:15:42.633669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.034076Z","title":null,"venue":null,"work_id":"3b2d077f-2d10-46cd-915c-f398c973f688","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:d53fc4ae7fd1b987fcdefb2a7faecbb887fa1fe7042b1f7daaf78424ca4f187a","observation_id":"6386e25e-a202-477f-8654-4f1c13e5276f","resolution":{"observed_at":"2026-07-06T11:52:23.035161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.23587","doi":"10.48550/arxiv.2510.23587","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of data agents: Emerging paradigm or overstated hype?CoRR, abs/2510.23587","venue":"Open MIND","work_id":"94f9da7d-ed8b-4c63-8b6a-b857c33a9fd4","year":2026},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:153730d4b76c6e8e0710f4859d70ed00b2ef928bbce7c4606c9403cce5c097be","observation_id":"3b072f25-056b-4621-91a6-8f124766d2f0","resolution":{"observed_at":"2026-07-01T09:15:43.452454Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.19794","doi":"10.48550/arxiv.2506.19794","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why do open-source llms struggle with data analysis? A systematic empirical study,","venue":"ArXiv.org","work_id":"bb619240-7164-4721-b637-ab7f9e342317","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:ea32498367f7d138938c42c62b182edef3939a057bbee97ceb9295e2e1144386","observation_id":"7c0eb2c7-21fa-496f-9192-d12ff07ab845","resolution":{"observed_at":"2026-07-01T09:15:42.733122Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06217","doi":"10.48550/arxiv.2510.06217","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tattoo: Tool-grounded thinking prm for test-time scaling in tabular reasoning","venue":"ArXiv.org","work_id":"0603d9b1-b638-4ccb-8fc0-a8ea79c812dd","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:8c7faf735ea3402bcb12a5148cd0f65acf75c2b89553c6bf7234e05cadcc60a1","observation_id":"2d69ff33-ea00-43ec-8ac5-0fb070562788","resolution":{"observed_at":"2026-07-01T09:15:42.552497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.18896","doi":"10.48550/arxiv.2506.18896","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasonflux-prm: Trajectory-aware prms for long chain-of-thought reasoning in llms","venue":"arXiv (Cornell University)","work_id":"909b544f-6432-416b-8e25-69156f9c292f","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:1c024ed6b52f7da9cacc4b7a6749c60041068ea44e70b1d06fe3381cda8ffd5c","observation_id":"c1915613-ff5e-4de7-b937-acd3e5209d56","resolution":{"observed_at":"2026-07-01T09:15:42.671429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.062001Z","title":"We sampled 100 tasks in DABench and TableBench, respectively, and measured the correlation between the model judge and human experts","venue":null,"work_id":"156a9340-ed01-4af8-8509-d93d4c92c8e1","year":2018},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:08fdc259d00f075f5807d22cb5e88130586e2100ae3decf98d5f17bf6ecae59e","observation_id":"ab82c19d-9723-45d5-8922-cedaa43140d1","resolution":{"observed_at":"2026-07-06T11:52:23.063725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.027972Z","title":"What is the calculation formula for the cost?","venue":null,"work_id":"b76c5c69-2b3c-486d-a892-5408e120ff24","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:dba13fd14076d54ef329444b57a7de97e86d8be5d0b2a07bc00547916f88d951","observation_id":"f28f77b1-89ab-4506-b3fb-f5ad258a9425","resolution":{"observed_at":"2026-07-06T11:52:23.029242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.032372Z","title":null,"venue":null,"work_id":"dec50834-8a88-4a62-9ed7-1635ffb3d149","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:d34726b0338b6f7c19df8815d664587134b8968371abd9124506ed627306a348","observation_id":"6dabe059-e969-40c1-9802-7d13fe60e321","resolution":{"observed_at":"2026-07-06T11:52:23.033505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.043741Z","title":null,"venue":null,"work_id":"31fd51fd-f0f2-4288-9779-53555bff142d","year":2018},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:a536ed6b2ee044c268eff757109b63a8e4240aedf1e4e845d5cb5f41d1367fa6","observation_id":"49477146-1075-4ff2-94c9-416e18f40f4b","resolution":{"observed_at":"2026-07-06T11:52:23.044876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.022932Z","title":null,"venue":null,"work_id":"e241b83c-84b4-4629-b20f-25f1811d4aa1","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:e0f258526b6ddc2eb86f71e3cda4d7eac2e9fbd2df68473a4fdcaaca6ee7d975","observation_id":"ecaf8eb9-cc49-4595-b76d-fc83fff582ab","resolution":{"observed_at":"2026-07-06T11:52:23.027264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.020881Z","title":"You should first an- alyze the correctness of the paragraph in ’<reason- ing></reasoning>’ part, then write code to verify your analysis in ’<code></code>’ part","venue":null,"work_id":"dcf9d869-5c91-40c0-b699-67c60f606543","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:0284faa249f5dfdc22d58d7e0c4133d56d6bac95f87cf05611a63887c9154db2","observation_id":"c130081e-b420-4b27-9930-470c0511d3ae","resolution":{"observed_at":"2026-07-06T11:52:23.022366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.039530Z","title":"Conference acronym ’XX, June 03–05, 2018, Woodstock, NY Qiu et al","venue":null,"work_id":"50e45cf2-c029-4f76-b5a8-1f8e5b1e2ab2","year":2018},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:14c15dd80620b2431702a658b46a0d56867f316b850eaea1129a09003590bdc9","observation_id":"9f6a4332-aeee-4678-a130-472e73b6c858","resolution":{"observed_at":"2026-07-06T11:52:23.040876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.016536Z","title":"You can use code to interact with the data files and verify the correctness of the paragraph","venue":null,"work_id":"68d1e9cf-ca9c-4c46-8e0b-641f234cf6ea","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:84bb5d77d41773d62543eb6fa03a56b61c9bf0bd723da41c0c95d3230d358c7f","observation_id":"27b9a2dc-342f-4f1a-bcd3-4586c5f048e1","resolution":{"observed_at":"2026-07-06T11:52:23.017970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.074627Z","title":null,"venue":null,"work_id":"ba7570ce-6ebf-47c7-8a15-ece25876a3d9","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:1f204b7b5ea50d4c3793e00644925ab976231980f966b6744d06ad0fef6b16ee","observation_id":"e0ea7d92-2477-4645-810d-5272d6860e4c","resolution":{"observed_at":"2026-07-06T11:52:23.075738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.018715Z","title":null,"venue":null,"work_id":"7b6c84e7-00e8-477c-9968-9454cdb6fd9f","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:243503a31c6c25aa27e3ab71cda08b4bd7a3ec4ce8f50b170266deab186ee42b","observation_id":"ad80b5a5-aaf6-4aef-a12e-1ed31227b66d","resolution":{"observed_at":"2026-07-06T11:52:23.020084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.007997Z","title":null,"venue":null,"work_id":"56def3ef-1af0-497e-b900-3ec70bd97079","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:984f53649b7ea102ce2f4f4c079d48be8b0c9df194585e821fa9a096090a9a2d","observation_id":"336ce17f-b708-4b71-b217-6d96702f4b25","resolution":{"observed_at":"2026-07-06T11:52:23.009511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.014040Z","title":"However, if there is an exception in the code of this paragraph, the variables in this code snippet will not be retained","venue":null,"work_id":"4bebf528-f70a-469e-9d3d-326874ba47c5","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:2d8ce60d2de56c372c90617d48a1f200f038cc4e93548c1f3b1a236064d43239","observation_id":"ca62a823-b5f0-42e3-a507-d9a2e0ea123e","resolution":{"observed_at":"2026-07-06T11:52:23.015740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.010569Z","title":null,"venue":null,"work_id":"c1429ccd-6128-4e6c-a104-11dd643309ef","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:1fd1f254493345bedfc7d98084d0af4052b9ad48626eb970e7bb1705d8bd42c8","observation_id":"8353af1a-8e81-49b8-9d10-feb8a2e98081","resolution":{"observed_at":"2026-07-06T11:52:23.011710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.012296Z","title":null,"venue":null,"work_id":"97f821fa-a499-4a75-bfff-5fe777770179","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:a1c32535f3e5927e43e63477752d4b23990ad55c5bfbf0061148aebfcb398466","observation_id":"4cd6e6a2-c676-48c1-95ca-89b479c25545","resolution":{"observed_at":"2026-07-06T11:52:23.013453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:52:23.006100Z","title":"# Format Example - Code Format: <reasoning> Your reasoning here, step by step, explaining your thought process and how you will verify the paragraph","venue":null,"work_id":"62c40a83-88ee-424a-a976-dfc8a5a935bd","year":null},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:364c2c225948790ad7e101d0a5a8d9e9e835cc10f4e863548ba9e1bff0e2f842","observation_id":"4e21b327-995f-4c2b-8ae2-58851f125b37","resolution":{"observed_at":"2026-07-06T11:52:23.007449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T12:39:50.702230Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":7,"metadata_mismatch":9,"parse_uncertain":0,"unresolved":24,"verified_exact":47,"verified_fuzzy":11},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 1 inbound Pith citation observation for arXiv:2604.24198."}