{"as_of":"2026-07-27T08:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ad8993bb4418b065388a6a52fcd9f10a9a4229c0197bc2f6e7840f6187ffdcfc","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T10:30:36.330305Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-27T06:30:09.085275+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.06326/citation-record","integrity":"/paper/2605.06326/integrity","json":"/paper/2605.06326/citation-record.json","paper":"/paper/2605.06326"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BeyondAIME: Advancing math reasoning evaluation beyond high school olympiads","venue":null,"work_id":"c8acf4f3-0fbb-4ecd-9ee4-cb3126e7f66f","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:6c2544a41497ce9cae0dfe38bc8814f835db1426d00a208317bc381781a0ead7","observation_id":"3ef03ec5-cd0a-472c-b3d4-15c318cbb99d","resolution":{"observed_at":"2026-05-26T15:07:52.167324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.13612","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"P1: Mastering physics olympiads with reinforcement learning","venue":null,"work_id":"99317d61-f809-481e-b7bf-f3d4794fce50","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:911d354fcf89634c999905dc2169129bc482737a76584e2df7b14af375733939","observation_id":"f4cbaaf8-da1c-4173-a86e-dcdbedf03e89","resolution":{"observed_at":"2026-05-11T20:01:10.717879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":"2502.01456","doi":"10.48550/arxiv.2502.01456","metadata_source":"pith","pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Process Reinforcement through Implicit Rewards","venue":"cs.LG","work_id":"c31a2126-86f9-44f3-91f3-208d0fc1463a","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:64ffe259962f17ff57560fbef3f826e68578152d7e0a822ef1ddbbd99c7bd330","observation_id":"67fb01e9-8d0f-45f0-ad67-f3bfa652af0a","resolution":{"observed_at":"2026-05-11T20:23:31.624298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22617","last_updated":"2025-05-28T17:38:45Z","snapshot_observed_at":"2026-07-06T21:32:23.537939Z","submitted_at":"2025-05-28T17:38:45Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","version":1},"cited_work":{"arxiv_id":"2505.22617","doi":"10.48550/arxiv.2505.22617","metadata_source":"pith","pith_arxiv_id":"2505.22617","snapshot_observed_at":"2026-07-10T21:57:38.198014Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","venue":"cs.LG","work_id":"d4b4aee4-d20f-4572-886a-4ba9ea6c9b81","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2505.22617","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:dafd1258848e854667784e6c98b064099e26222af5ba37e5035d444d4635697a","observation_id":"bd7eadbb-522a-47cb-b3d0-6f7b98313927","resolution":{"observed_at":"2026-05-12T12:31:34.026635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:8be351638d41bbc3b2caa9336cd10e6049cd79135af41740d57404c5ba79d1db","observation_id":"addafae5-b38a-4918-8ccf-59b87b3f5d50","resolution":{"observed_at":"2026-05-11T20:01:10.671349Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":"2512.02556","doi":"10.18653/v1/d18-1512","metadata_source":"pith","pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","venue":"cs.CL","work_id":"07c85cc5-4086-4abc-823b-6d0f4ff784d0","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:a75609a790869a65b0b661466baba4555d95fae6a54cf02a04b1c1ba1e49e700","observation_id":"6bf56622-afd6-4249-b357-0bc8fce0c485","resolution":{"observed_at":"2026-05-11T20:01:10.681347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00674","last_updated":"2026-05-15T17:10:37Z","snapshot_observed_at":"2026-07-06T23:14:01.852096Z","submitted_at":"2026-05-01T13:56:34Z","title":"Beyond Benchmarks: MathArena as an Evaluation Platform for Mathematics with LLMs","version":2},"cited_work":{"arxiv_id":"2605.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.00674","snapshot_observed_at":"2026-07-10T09:37:00.861422Z","title":"Beyond Benchmarks: MathArena as an Evaluation Platform for Mathematics with LLMs","venue":"cs.CL","work_id":"a302077a-ac03-4988-adce-c84a57db5425","year":2026},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2605.00674","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:0e4e443a2ca6260c77f00668a94d8a36035f05a2037cf940e3c93545ab4e72be","observation_id":"c09e257d-6e09-4d8b-8104-da74c0ddfd66","resolution":{"observed_at":"2026-05-11T20:01:10.694352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19849","last_updated":"2025-07-26T07:53:11Z","snapshot_observed_at":"2026-07-06T22:03:15.296567Z","submitted_at":"2025-07-26T07:53:11Z","title":"Agentic Reinforced Policy Optimization","version":1},"cited_work":{"arxiv_id":"2507.19849","doi":"10.48550/arxiv.2507.19849","metadata_source":"pith","pith_arxiv_id":"2507.19849","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Agentic Reinforced Policy Optimization","venue":"cs.LG","work_id":"6cb0d241-5e4d-44ed-9476-659819ec0681","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2507.19849","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:787fb16bc14d6ae2c810141b133830e2d033102068c58af65645b721cee70027","observation_id":"deeb0325-6557-42bb-bfa2-1fb6be05e984","resolution":{"observed_at":"2026-05-17T02:57:12.173630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.15489","doi":"10.48550/arxiv.2512.15489","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Nemotron-math: Efficient long-context distillation of mathematical reasoning from multi-mode supervision.arXiv preprint arXiv:2512.15489","venue":null,"work_id":"16de9c46-5d5d-4579-a32f-e128fd7c4d74","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:d9f7036f981f202318e1e221483a6c665ce2e471129bc5aeedc4806a2c69743d","observation_id":"a69e4bd6-50cc-422e-8cbb-408aac6acebc","resolution":{"observed_at":"2026-05-11T20:01:10.727023Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.17325","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:45:40.221698Z","title":"Generalizable end-to-end tool-use rl with synthetic codegym","venue":null,"work_id":"68bb892c-810d-4e02-a2e3-1a0127076a58","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:543ca9468e6ca299a8026bc543c5243ce5c65450f09ff7ab3fb5c31c328c7038","observation_id":"9e27cc99-8019-4afb-a1aa-1442fc386e44","resolution":{"observed_at":"2026-05-11T20:01:10.412358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":"2504.11536","doi":"10.48550/arxiv.2504.11536","metadata_source":"pith","pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","venue":"cs.CL","work_id":"6da510e4-e55c-4412-b7c8-839984508e99","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:b41bcefce81155f86c8d642de69680ca05b07f4be59b7920f6f7de21f0f80e57","observation_id":"47f04c2c-54a3-451b-b63d-9c54ae7f12ab","resolution":{"observed_at":"2026-05-13T18:42:39.160125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PAL: Program-aided language models","venue":null,"work_id":"90abbfbb-277f-440a-acc6-0505d4836c92","year":2023},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:6a1e7e03d4bf913a291b8709d975ab4a8e3072320b8ff9aa371f95ccb86af3c3","observation_id":"b67904ab-5b14-4bc8-b94a-f2d9a2c6250b","resolution":{"observed_at":"2026-05-26T15:07:52.191811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How to train long-context language models (effectively)","venue":null,"work_id":"f31712cf-d22e-48ee-842c-a8005f938e57","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:e90b1d169b10693c46618251ca54e4a004b82ceba2e603d9a3c550afa9330f6f","observation_id":"7a9f3bcb-93c7-47fb-a226-7979eba5bdbc","resolution":{"observed_at":"2026-05-26T15:07:52.179443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04178","last_updated":"2025-06-05T02:21:52Z","snapshot_observed_at":"2026-07-06T21:36:40.449308Z","submitted_at":"2025-06-04T17:25:39Z","title":"OpenThoughts: Data Recipes for Reasoning Models","version":2},"cited_work":{"arxiv_id":"2506.04178","doi":"10.48550/arxiv.2506.04178","metadata_source":"pith","pith_arxiv_id":"2506.04178","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"OpenThoughts: Data Recipes for Reasoning Models","venue":"cs.LG","work_id":"c7acbe41-27a0-4773-a7be-8f08d86cdf21","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2506.04178","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:d1ca38aff71646ee5f3883d41c7120796b6a6e0bd745fce9074ecbdfd0438010","observation_id":"a5868a2b-3cef-43a7-9d09-44a1e6dc2379","resolution":{"observed_at":"2026-05-12T04:57:51.597669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.169741+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.169741+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:33:45.146128Z","title":"Justrl: Scaling a 1.5 b llm with a simple rl recipe","venue":null,"work_id":"fae7d2ce-42fc-469f-9b46-42b5103f2013","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:1b1af182d1f1b3e20cdfa12b68a505d9f6c3978775112dad4193beb2dd72192b","observation_id":"bf9f07b5-ad62-4ef4-b28f-3ab3d68faa9c","resolution":{"observed_at":"2026-05-11T20:01:10.562408Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":"2403.07974","doi":"10.1109/icsme52107.2021.00025","metadata_source":"pith","pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":"cs.SE","work_id":"ea9e51ce-1e75-4182-92d8-4d25f70d2ee4","year":2024},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:fb6607f9f8a036398e3cfc02bc6db8b36f46223c0b9df9bb430d6e8b60ede6de","observation_id":"c4b90e7e-64c0-40fa-a396-315544f6f075","resolution":{"observed_at":"2026-05-11T20:01:10.593494Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rocode: Integrating backtracking mechanism and program analysis in large language models for code generation","venue":null,"work_id":"7b233544-52b3-44d4-9917-ca1f112a2483","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:cd47c2fe87148c314c610db891d6663404b251b6d605caeeda9c704466d04796","observation_id":"b0c0b85f-b8d4-4a56-8f4e-e0209c855504","resolution":{"observed_at":"2026-05-26T15:07:52.173566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09820","last_updated":"2025-06-12T12:50:37Z","snapshot_observed_at":"2026-07-06T21:40:26.217708Z","submitted_at":"2025-06-11T14:59:02Z","title":"CoRT: Code-integrated Reasoning within Thinking","version":2},"cited_work":{"arxiv_id":"2506.09820","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09820","snapshot_observed_at":"2026-07-02T20:47:23.394845Z","title":"Cort: Code-integrated reasoning within thinking","venue":null,"work_id":"3516731c-e278-4c80-a3d4-30edd114bbec","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2506.09820","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:5e310c9cbe923d8ac96a660b9862df8b56695f103a93db657ed0dd1f66c12d0d","observation_id":"6e62392c-8aa9-4984-9d28-a21c31bbd9ba","resolution":{"observed_at":"2026-05-11T20:01:10.574750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Numinamath: The largest public dataset in ai4maths with 860k pairs of competition math problems and solutions.Hugging Face repository, 13:9","venue":null,"work_id":"43399ba9-4b23-4c15-96f4-9661021f2e65","year":2024},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:0eefd35b750a03e968c3c40ab15b7b5e988102942d4893bb333355cdf7699a5d","observation_id":"0c20af3f-5b27-4c2e-8c21-f691252da1da","resolution":{"observed_at":"2026-05-26T15:07:52.194324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.08274","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Discovery and reinforcement of tool-integrated reasoning chains via rollout trees","venue":null,"work_id":"735898e4-933d-40f4-b33d-d5ea9da45d0a","year":2026},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:4ca57563a324f51005c22a52d0710f7e29776c01654b1672df9260c10404d622","observation_id":"ec2066e2-154f-48f6-9c34-80fc5b6df27e","resolution":{"observed_at":"2026-05-11T20:01:10.580856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.23087","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Taming the tail: Stable llm reinforcement learning via dynamic vocabulary pruning","venue":null,"work_id":"689cf8b0-208d-456b-8155-1d0d9ad978b5","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:93e54caabe385ef9d847f9b9e0c13114cf7dede31ca5ea0a3708d6b194411634","observation_id":"387e2a8d-5110-498e-bc0f-17967b404cf0","resolution":{"observed_at":"2026-05-11T20:01:10.405568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19201","last_updated":"2025-08-26T17:03:46Z","snapshot_observed_at":"2026-07-06T22:19:00.152099Z","submitted_at":"2025-08-26T17:03:46Z","title":"Understanding Tool-Integrated Reasoning","version":1},"cited_work":{"arxiv_id":"2508.19201","doi":"10.48550/arxiv.2508.19201","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19201","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Understanding tool-integrated reasoning","venue":null,"work_id":"d7b833e3-8bfb-4ff0-b539-8c12f6ef11e0","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2508.19201","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:af01ad35ffbd4f0b3355a168f4171e6cc4ab87a169fc1970c514c8222a2ab895","observation_id":"7b380701-1f7e-4084-b4c3-f793bf983a2d","resolution":{"observed_at":"2026-05-11T20:01:10.427044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When speed kills stability: Demystifying rl collapse from the training-inference mismatch.Notion Blog","venue":null,"work_id":"f216722a-c2c2-4593-90f7-5dee816e16cc","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:644c4020684f9785412cc52df1f1641c619c6fea386a6fad50bab6d846cf3f8b","observation_id":"adf19fb3-4f2b-48ce-8aff-469aefc6599c","resolution":{"observed_at":"2026-05-26T15:07:52.170822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.093376Z","title":"In: Christodoulopoulos, C., Chakraborty, T., Rose, C., Peng, V","venue":null,"work_id":"e6d6ecae-3575-45e2-8c99-76359a926a1a","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:6748d062a64923eeb79e711e744fdd5a8e7cee10b95a7ab8a250b1c349240b8b","observation_id":"3d661578-4f7b-46cd-a0c6-0cc0d0dc1606","resolution":{"observed_at":"2026-05-08T22:04:16.314834Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-20T23:52:02.41257+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-20T23:52:02.41257+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09443","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:02:23.940048Z","title":"P1-vl: bridging visual perception and scientific reasoning in physics olympiads","venue":null,"work_id":"642152d1-f64d-4d5e-a0b2-53c80ac841b3","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:daf3a1243af8646f93836c31031f1728a03d993da169c0e6f76472d9336d702e","observation_id":"8fa5e5dd-2d26-46f0-b11a-9ae8843df971","resolution":{"observed_at":"2026-05-11T20:01:10.550096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e990104d-8d43-4d54-adfc-319f7e3b63b6","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:6dce570c415098a7d8038ae7c9506446f7441db3dccbf229b07162aaaa19cee6","observation_id":"bb3f2994-4764-42d7-90ae-b2202d5afd14","resolution":{"observed_at":"2026-05-26T15:07:52.184481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.11370","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.153429Z","title":"Stabilizing MoE Reinforcement Learning by Aligning Training and Inference Routers","venue":null,"work_id":"4df9a4a1-3908-4d16-9c0b-253bb245a0c4","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:3006d332f14ce0319fe6148bf4c0fb9b768299b4f0839a67b409d246aec5a56d","observation_id":"665d6b1e-c68e-4bd4-952f-06692a0fc59d","resolution":{"observed_at":"2026-05-11T20:01:10.510364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":"2508.10925","doi":"10.3115/1073083.1073135","metadata_source":"pith","pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","venue":"cs.CL","work_id":"178c1f7e-4f19-4392-a45d-45a6dfa88ead","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:d4469821f15e7b9f4e7107fd23d7e6fc6fc179b1b8d7c5f3d6c7d5a59c3b9b98","observation_id":"5e52a6fd-ced8-4fa9-9229-77d5f35150a8","resolution":{"observed_at":"2026-05-11T20:01:10.524954Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:19f4d11d70203336d68b50ff7b025cf01bcdeb732b640459d77fe8cc22ce7bb3","observation_id":"1c8db598-948e-48ee-9b2d-32a1d88c87ed","resolution":{"observed_at":"2026-05-11T20:01:10.529637Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:14:00.898380Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":"1a65f421-2e48-4c87-8f62-4057a79265f3","year":2024},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:3f859310f2b37c5ffad9aa4b00377b22bcf8508e738580ca66a03d8735831133","observation_id":"20e06971-ae9c-4b2b-8701-c96801aaddf1","resolution":{"observed_at":"2026-05-26T15:07:52.187199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20722","last_updated":"2025-08-28T12:45:25Z","snapshot_observed_at":"2026-07-06T22:20:02.908814Z","submitted_at":"2025-08-28T12:45:25Z","title":"rStar2-Agent: Agentic Reasoning Technical Report","version":1},"cited_work":{"arxiv_id":"2508.20722","doi":"10.48550/arxiv.2508.20722","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20722","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Zhihong Shao, Peiyi Wang, Qihao Zhu, Runxin Xu, Junxiao Song, Xiao Bi, Haowei Zhang, Mingchuan Zhang, YK Li, Yang Wu, and 1 others","venue":null,"work_id":"c32843ff-ee26-40a1-a436-198c5480f68f","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2508.20722","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:8ec8c2790f4fe4c08173e07eff86ba6cde7838fb0e1d161c7010fc08c8f1a24b","observation_id":"a3e970f5-5a02-484a-a52b-31115fe346fe","resolution":{"observed_at":"2026-05-11T20:01:10.556776Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:61f331a3a3faff9fb2bf5f01389dcf93e1dfb4a381aba7a34b3ac3162f90c5cc","observation_id":"56450165-65c3-4e8f-8d57-778836720ea5","resolution":{"observed_at":"2026-05-11T20:01:10.400143Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MIT press","venue":null,"work_id":"a478b6df-acab-494d-9741-fdf653bf00cc","year":2018},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:70904aabffdf67a6c83599c1c73647ef6bd2e8c931eb71eef8df8be9bcbbf385","observation_id":"c8524664-18f1-4fd6-acca-543ee1efa219","resolution":{"observed_at":"2026-05-26T15:07:52.176584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-07-11T01:07:44.097694Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:8a6e63220444fda43459df92467e76c1341d181bb023cca5e587cab736c7c12b","observation_id":"cd3622c8-9c89-41ca-b167-25be88eeebd1","resolution":{"observed_at":"2026-05-11T20:01:10.382936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":"2602.02276","doi":"10.48550/arxiv.2602.02276","metadata_source":"pith","pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Kimi K2.5: Visual Agentic Intelligence","venue":"cs.CL","work_id":"d690be8f-5d53-49b0-b1e7-79668eb8fcdb","year":2026},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:3d6bc458050ed26d47682ce8d65ff774bbe0b57ce7660b1b10c28bd7f6ffbffc","observation_id":"28545870-e9b6-46d6-804b-3c08507fee5b","resolution":{"observed_at":"2026-05-11T20:01:10.515399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minimax m2.7: Early echoes of self-evolution","venue":null,"work_id":"cba88af3-04a8-431b-a682-78e719b1651e","year":2026},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:bef3751fd4fee9832a8c842779e2398eb15161375a7171fd92258b8c933ebfa0","observation_id":"95bf1353-d584-426c-a129-5992e47e4f41","resolution":{"observed_at":"2026-05-26T15:07:52.181682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.14967","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T22:47:36.769512Z","title":"Information gain-based policy optimization: A simple and effective approach for multi-turn llm agents","venue":null,"work_id":"c61c2301-5e65-4715-ac09-dcc479c633ad","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:016477aa26ee65031ad647bf5c0451757e4ce2ac3175b0f9a09ef3d0bab2c6ab","observation_id":"f306f1c1-fe18-40f8-9fcd-90e285ae148a","resolution":{"observed_at":"2026-05-11T20:01:10.481341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21165","doi":"10.48550/arxiv.2601.21165","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Frontierscience: Evaluating ai’s ability to perform expert-level scientific tasks","venue":null,"work_id":"cb5985eb-b2ed-45b4-9d1d-a9eb8a46a6ca","year":2026},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:520c22de3fde8a7db89201ea195ac7e4cea62ab145ca0eef95b82471377430ad","observation_id":"a895fe30-9bab-406a-b83b-fdfd3cc3f986","resolution":{"observed_at":"2026-05-11T20:01:10.388271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.16043","doi":"10.48550/arxiv.2511.16043","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Agent0: Unleashing self-evolving agents from zero data via tool-integrated reasoning","venue":null,"work_id":"d7e7b19a-a84a-42be-ad4a-550238c4747c","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:7dec6706db1851ebdc6c27caaba78112c060652b233e88945280cd5d10392d3a","observation_id":"6ba77ecd-e935-4f3c-a055-b9ad52946b9d","resolution":{"observed_at":"2026-05-11T20:01:10.492259Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02479","last_updated":"2025-09-03T17:06:42Z","snapshot_observed_at":"2026-07-06T22:22:21.808673Z","submitted_at":"2025-09-02T16:30:19Z","title":"SimpleTIR: End-to-End Reinforcement Learning for Multi-Turn Tool-Integrated Reasoning","version":2},"cited_work":{"arxiv_id":"2509.02479","doi":"10.48550/arxiv.2509.02479","metadata_source":"pith","pith_arxiv_id":"2509.02479","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SimpleTIR: End-to-end reinforcementlearningformulti-turntool-integratedreasoning.arXivpreprint","venue":"cs.LG","work_id":"7fab711c-66c5-439e-b937-3b87965f8efb","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2509.02479","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:e1979597434e6f612de3df47ae29c7a1d9aa07b6c0195f6c3005631dda11a8b0","observation_id":"ac9ea6eb-31f3-4f26-b14a-8460bc5b76b7","resolution":{"observed_at":"2026-05-11T20:01:10.534979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:5fe11ae7140d0eadf4f9e8fde8109265b4802f42a640e635b2c1deb9613bac9f","observation_id":"9bc7adef-3517-4e7d-b04b-6c1750a524ca","resolution":{"observed_at":"2026-05-11T20:01:10.455585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.11701","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T22:47:37.001617Z","title":"Demystifying reinforcement learning in agentic reasoning","venue":null,"work_id":"d53b8c16-48ac-427a-83a6-31ca0addca9b","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:555e82d432005a6b764c4c65cc070ef24bdd7b6d4c93ae03b6fecca35996595e","observation_id":"e9787b34-b25d-470f-9327-54c8142e21d2","resolution":{"observed_at":"2026-05-11T20:01:10.463046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T04:05:55.476500Z","title":"arXiv preprint arXiv:2509.25123 , year=","venue":null,"work_id":"fa71b9a8-6156-4143-b27b-4628df9c9a4b","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:fa5cc62967ca03d963873e36b0db1e3c58a9ad169552fdea79440243d9a717a3","observation_id":"f6022caf-b35d-4077-95eb-a0a0d37476a4","resolution":{"observed_at":"2026-05-11T20:01:10.504532Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":"2503.18892","doi":"10.48550/arxiv.2503.18892","metadata_source":"pith","pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","venue":"cs.LG","work_id":"94a68437-02e7-425a-91b2-5846ddcbd38c","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:8f2aa19fa6c94c8f6f447d5497d634b14afda3851752af47bc22e0227973fa7a","observation_id":"172ba5bd-3c15-4fda-8618-7dc986178572","resolution":{"observed_at":"2026-05-13T08:21:05.971096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"cited_work":{"arxiv_id":"2509.08827","doi":"10.48550/arxiv.2509.08827","metadata_source":"pith","pith_arxiv_id":"2509.08827","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","venue":"cs.CL","work_id":"7618c14b-e527-4268-9926-d4f462ea9925","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2509.08827","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:d1c9f252b26bd1aab38ade5ee4d8fdf638713ed28dad2d08f881582faf29fd00","observation_id":"e82a96c8-ea1e-4f09-a2f0-ca96ff56852a","resolution":{"observed_at":"2026-05-18T00:02:25.511734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.11408","doi":"10.48550/arxiv.2508.11408","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"arXiv preprint arXiv:2508.11408 , year=","venue":null,"work_id":"994df3c4-5dc6-45c0-9db5-e82e415ce5d8","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:3c1d0ff91eaffa8aecdfa4fa9100967ee08b58ef28db137e51dfbd58fee7cc3f","observation_id":"032d17cb-66cc-4427-9ec9-a56bd8f2b6e0","resolution":{"observed_at":"2026-05-11T20:01:10.612376Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.01204","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:58:43.804661Z","title":"Aster: Agentic scaling with tool-integrated extended reasoning.arXiv preprint arXiv:2602.01204, 2026c","venue":null,"work_id":"35f66d01-6073-4eb8-aa48-8efac6357a73","year":2026},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:180a784ebe19cd93444081362bc0a193fd7670dfba49ec52bd64a8d16e575688","observation_id":"24c9aee2-4be6-428c-9ac7-183078a7e3dd","resolution":{"observed_at":"2026-05-11T20:01:10.603160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.12867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:39:49.617866Z","title":"Tool-r1: Sample-efficient reinforcement learning for agentic tool use","venue":null,"work_id":"bf70056a-5d9a-4fab-8b8a-6a8340b3f183","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:f42673c6580b275bd173bfbab2a33f80a120fab3c12cf0eea5a247ff9f114ffb","observation_id":"d22bc3a9-17f2-4fce-93e5-7d4b89b5764d","resolution":{"observed_at":"2026-05-11T20:01:10.434798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.01374","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:48:39.913120Z","title":"Stabilizing reinforcement learning with llms: Formulation and practices.arXiv preprint arXiv:2512.01374, 2025a","venue":null,"work_id":"2881a661-1c4c-4e66-abba-aa3a176aadff","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:b3cd9d34e56be9147ec575ad1b02b3eeb61dfae7cd94981514037eecf3139edc","observation_id":"29968e6d-cbc3-47a7-90ab-6b241cb2c669","resolution":{"observed_at":"2026-05-11T20:01:10.469001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"slime: An llm post-training framework for rl scaling","venue":null,"work_id":"10776060-f7db-42bc-a52b-c192d5fecd9d","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:b801cb328e7b2e230c9df3868f5127fef683e346d20c0a2c64f3894391092842","observation_id":"bfdc0c0e-5e98-4e4b-ad09-8d45e48d039e","resolution":{"observed_at":"2026-05-26T15:07:52.189283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16084","last_updated":"2025-06-30T15:59:26Z","snapshot_observed_at":"2026-07-06T21:13:13.686703Z","submitted_at":"2025-04-22T17:59:56Z","title":"TTRL: Test-Time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2504.16084","doi":"10.48550/arxiv.2504.16084","metadata_source":"pith","pith_arxiv_id":"2504.16084","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"TTRL: Test-Time Reinforcement Learning","venue":"cs.CL","work_id":"54ef1983-e8f7-4b17-9b74-6155b56c8b00","year":2025},"citing_paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-08T10:30:36.330305Z"},"links":{"cited_paper":"/paper/2504.16084","citing_paper":"/paper/2605.06326"},"observation_digest":"sha256:29aa675dce7055794e0318a5e717f719885910461fc7bbd624301186dc6cf939","observation_id":"4063b9a7-cab4-43fb-9a97-5c4e12a4dc8c","resolution":{"observed_at":"2026-05-11T20:01:10.420787Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.06326","last_updated":"2026-05-07T14:23:21Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:21Z","title":"Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":36,"verified_fuzzy":11},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"thesis":"As of 27 July 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2605.06326."}