{"as_of":"2026-08-08T07:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54589dff980971dc4b621895a82d801f12018f806b14083d67fad8d6e53a2ee0","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:23:55.366230Z","state":"measured"},{"denominator":86,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":86,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:57:35.839876Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T23:57:35.839876Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.13167","last_updated":"2025-08-06T17:01:02Z","snapshot_observed_at":"2026-08-05T23:57:29.481263Z","submitted_at":"2025-08-06T17:01:02Z","title":"Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T23:57:35.839876Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2508.13167"},"observation_digest":"sha256:4ed959764bcc66cc983b76385b591583f9a2d178455fd7b68798ac7ce15e7690","observation_id":"be2f730c-502f-49ba-afd5-8c9677e23336","resolution":{"observed_at":"2026-08-05T23:57:35.839876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-04T14:49:51.602433Z","title":"Au- totir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23292","last_updated":"2026-06-29T12:46:01Z","snapshot_observed_at":"2026-08-07T20:42:40.147533Z","submitted_at":"2025-09-27T13:10:37Z","title":"Learning How to Use Tools, Not Just When: Pattern-Aware Tool-Integrated Reasoning","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T14:49:51.602433Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2509.23292"},"observation_digest":"sha256:7291e3c8cecbb3649278f7874bb4dd3d484942f2af5f321309a8f64663a5d276","observation_id":"1ab86500-5dbb-4b41-98a7-8edf3269a992","resolution":{"observed_at":"2026-08-04T14:49:51.602433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-04T06:57:16.012421Z","title":"Yang, A.; Zhang, B.; Hui, B.; Gao, B.; Yu, B.; Li, C.; Liu, D.; Tu, J.; Zhou, J.; Lin, J.; Lu, K.; Xue, M.; Lin, R.; Liu, T.; Ren, X.; and Zhang, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.27568","last_updated":"2026-06-18T02:08:20Z","snapshot_observed_at":"2026-08-07T20:39:51.915446Z","submitted_at":"2025-10-31T15:51:00Z","title":"SIGMA: Search-Augmented On-Demand Knowledge Integration for Agentic Mathematical Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T06:57:16.012421Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2510.27568"},"observation_digest":"sha256:d6932f65dd8de808578aaa5f45e1bd653c60a6424778fa5c166e5efc73df3aee","observation_id":"9bce88ff-83e7-4b1d-ac9e-3ded845d3cf5","resolution":{"observed_at":"2026-08-04T06:57:16.012421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-03T11:44:07.353535Z","title":"Preprint, arXiv:2507.21836","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.05366","last_updated":"2026-06-28T19:14:17Z","snapshot_observed_at":"2026-08-08T02:37:22.393269Z","submitted_at":"2026-01-08T20:44:28Z","title":"Lost in Execution: On the Multilingual Robustness of Tool Calling in Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T11:44:07.353535Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2601.05366"},"observation_digest":"sha256:08388dedc0a8ad8437bc6916270dfdafce87792a7643ef4a262fb4d0196cb89b","observation_id":"db6d5a77-182a-41f6-9d2e-2679ff59999e","resolution":{"observed_at":"2026-08-03T11:44:07.353535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-03T09:21:45.096788Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14192","last_updated":"2026-07-03T11:26:58Z","snapshot_observed_at":"2026-08-07T15:05:40.772054Z","submitted_at":"2026-01-20T17:51:56Z","title":"Toward Efficient Agents: Memory, Tool learning, and Planning","version":2},"reference_index":142,"source":"pdf_text","source_observed_at":"2026-08-03T09:21:45.096788Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2601.14192"},"observation_digest":"sha256:9eabf975a937c5d93d2fc27c61685d50e6081f7269f7d25990f30fbe833e0c56","observation_id":"728c2d82-7c0c-4661-ae86-f1a6a9442a46","resolution":{"observed_at":"2026-08-03T09:21:45.096788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-03T05:56:57.193714Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.00994","last_updated":"2026-05-28T05:45:59Z","snapshot_observed_at":"2026-08-03T20:08:32.559639Z","submitted_at":"2026-02-01T03:19:22Z","title":"Reasoning and Tool-use Compete in Agentic RL:From Quantifying Interference to Disentangled Tuning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:57.193714Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2602.00994"},"observation_digest":"sha256:3c1173d5fb599c945f0d1eadde44f565b040927a0dfdca73988ab52daaaf962b","observation_id":"ac93b3b1-bcd6-4ace-9141-1a7860485d3f","resolution":{"observed_at":"2026-08-03T05:56:57.193714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.21836","doi":"10.48550/arxiv.2507.21836","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836","venue":"arXiv (Cornell University)","work_id":"88ab61fc-4f06-4277-9bce-39504caf0758","year":2025},"citing_paper":{"arxiv_id":"2604.07900","last_updated":"2026-04-09T07:17:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T07:17:00Z","title":"AnomalyAgent: Agentic Industrial Anomaly Synthesis via Tool-Augmented Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T18:32:31.955785Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2604.07900"},"observation_digest":"sha256:bded6ef3e0dd19d4db015666a3699fc0134b146477d83eb2d052956419610196","observation_id":"1f3e87f2-3491-4609-a0ec-8b177e8d9f8f","resolution":{"observed_at":"2026-05-10T18:35:42.825362Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.21836","doi":"10.48550/arxiv.2507.21836","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836","venue":"arXiv (Cornell University)","work_id":"88ab61fc-4f06-4277-9bce-39504caf0758","year":2025},"citing_paper":{"arxiv_id":"2604.24339","last_updated":"2026-04-27T11:31:15Z","snapshot_observed_at":"2026-07-06T23:10:24.992210Z","submitted_at":"2026-04-27T11:31:15Z","title":"See Further, Think Deeper: Advancing VLM's Reasoning Ability with Low-level Visual Cues and Reflection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-08T04:46:16.497585Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2604.24339"},"observation_digest":"sha256:e1dad55abc879676d9499312efa49ca1bcd3db1419c5de5f29de12abea3454a3","observation_id":"d0287446-3114-4176-936c-605bc0cd6bad","resolution":{"observed_at":"2026-05-11T21:36:17.711402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.21836","doi":"10.48550/arxiv.2507.21836","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836","venue":"arXiv (Cornell University)","work_id":"88ab61fc-4f06-4277-9bce-39504caf0758","year":2025},"citing_paper":{"arxiv_id":"2605.07339","last_updated":"2026-05-08T06:44:11Z","snapshot_observed_at":"2026-07-31T12:37:52.379547Z","submitted_at":"2026-05-08T06:44:11Z","title":"Tools as Continuous Flow for Evolving Agentic Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T01:30:19.859374Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2605.07339"},"observation_digest":"sha256:c48a8900d0cc2dca8d7b38a06e2e41468002e8137bb5cda1f623a91eed64a2e8","observation_id":"e63939b4-76ff-4201-b75d-125c52cf8ac7","resolution":{"observed_at":"2026-05-11T01:45:51.740826Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.21836","doi":"10.48550/arxiv.2507.21836","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836","venue":"arXiv (Cornell University)","work_id":"88ab61fc-4f06-4277-9bce-39504caf0758","year":2025},"citing_paper":{"arxiv_id":"2605.08693","last_updated":"2026-05-12T07:27:47Z","snapshot_observed_at":"2026-08-03T00:36:25.133013Z","submitted_at":"2026-05-09T05:03:00Z","title":"SkillMaster: Toward Autonomous Skill Mastery in LLM Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T00:59:03.361037Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2605.08693"},"observation_digest":"sha256:5b3283bd691dfd90f91f14605143874fe23776def3c799bcc5bf10166f0dbf6b","observation_id":"9f34793a-d609-49d1-806b-6a4190184c37","resolution":{"observed_at":"2026-05-12T08:36:24.078934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.21836","doi":"10.48550/arxiv.2507.21836","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836","venue":"arXiv (Cornell University)","work_id":"88ab61fc-4f06-4277-9bce-39504caf0758","year":2025},"citing_paper":{"arxiv_id":"2605.08693","last_updated":"2026-05-12T07:27:47Z","snapshot_observed_at":"2026-08-03T00:36:25.133013Z","submitted_at":"2026-05-09T05:03:00Z","title":"SkillMaster: Toward Autonomous Skill Mastery in LLM Agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T07:30:09.985448Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2605.08693"},"observation_digest":"sha256:7681c393808955b3fb3b0a3cf176452e6fcd91f64c96a4db5bf522c215eafa30","observation_id":"a3d8a207-1068-45b0-b0d7-6ec3032c8f74","resolution":{"observed_at":"2026-05-13T07:32:29.862504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.21836","doi":"10.48550/arxiv.2507.21836","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836","venue":"arXiv (Cornell University)","work_id":"88ab61fc-4f06-4277-9bce-39504caf0758","year":2025},"citing_paper":{"arxiv_id":"2605.09544","last_updated":"2026-05-10T13:56:46Z","snapshot_observed_at":"2026-07-31T07:40:23.585067Z","submitted_at":"2026-05-10T13:56:46Z","title":"TIDE-Bench: Task-Aware and Diagnostic Evaluation of Tool-Integrated Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-12T02:47:31.830410Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2605.09544"},"observation_digest":"sha256:24d61a12e6c9996e45d4524cc8f06656064730986623724460702dc113e0051f","observation_id":"feb34b55-7224-4cf2-8cbb-144ff2b23b32","resolution":{"observed_at":"2026-05-12T07:31:23.948998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.21836","doi":"10.48550/arxiv.2507.21836","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836","venue":"arXiv (Cornell University)","work_id":"88ab61fc-4f06-4277-9bce-39504caf0758","year":2025},"citing_paper":{"arxiv_id":"2606.02132","last_updated":"2026-06-02T07:53:40Z","snapshot_observed_at":"2026-08-03T12:22:05.499867Z","submitted_at":"2026-06-01T11:58:55Z","title":"Learning When Not to Act: Mitigating Tool Abuse in Agentic Reinforcement Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-28T14:59:57.983338Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2606.02132"},"observation_digest":"sha256:f3596b35fbcf8a517161c32c579283b17952a8e204442b09bd20987e5f036912","observation_id":"d0e8bf0e-7946-4e2d-aca4-9c72cdbb2022","resolution":{"observed_at":"2026-07-01T22:46:20.257307Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.21836","doi":"10.48550/arxiv.2507.21836","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autotir: Autonomous tools integrated reasoning via reinforcement learning.arXiv preprint arXiv:2507.21836","venue":"arXiv (Cornell University)","work_id":"88ab61fc-4f06-4277-9bce-39504caf0758","year":2025},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":223,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:a82a692d92c7b26d4449d57ee0a574ff3e4149beddf000464981ee1dd55eb39e","observation_id":"60831c2a-f04d-4715-80d4-9105dcd716b8","resolution":{"observed_at":"2026-07-04T08:09:40.721699Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21836","snapshot_observed_at":"2026-08-05T04:18:15.288921Z","title":"Xue, Z.; Zheng, L.; Liu, Q.; Li, Y.; Zheng, X.; MA, Z.; and An, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04007","last_updated":"2026-08-04T17:59:21Z","snapshot_observed_at":"2026-08-07T23:12:48.903780Z","submitted_at":"2026-08-04T17:59:21Z","title":"TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T04:18:15.288921Z"},"links":{"cited_paper":"/paper/2507.21836","citing_paper":"/paper/2608.04007"},"observation_digest":"sha256:9f91b69d60f9050d38716b1287587427143aff318e36a92d806c72a579e27e30","observation_id":"998ceb97-64bb-4584-b4fa-38fd5bc6ced9","resolution":{"observed_at":"2026-08-05T04:18:15.288921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.21836/citation-record","integrity":"/paper/2507.21836/integrity","json":"/paper/2507.21836/citation-record.json","paper":"/paper/2507.21836"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.491111Z","title":"H.; Meade, N.; and Reddy, S","venue":null,"work_id":"ccc55843-d8ef-4a67-ab0b-5b13636cd209","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.032507Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:0b782245e8739dde04cc14e42d8deb99d5e9ee350c780558bcd1df9a82b22273","observation_id":"1649d66e-f102-48f1-8b9c-95e736f8a63a","resolution":{"observed_at":"2026-08-06T12:23:56.496044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19470","last_updated":"2025-09-23T03:45:42Z","snapshot_observed_at":"2026-07-06T20:58:19.305457Z","submitted_at":"2025-03-25T09:00:58Z","title":"ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19470","snapshot_observed_at":"2026-08-06T12:23:55.037983Z","title":"Z.; Zhang, W.; Chen, H.; Yang, F.; et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.037983Z"},"links":{"cited_paper":"/paper/2503.19470","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:50b9719c3418a26946c6d8f136ce7dbe1b04629fd1fdbec8e1a60d59b729273a","observation_id":"d971dcd4-8e1e-40ad-a97b-16364f1c9a1f","resolution":{"observed_at":"2026-08-06T12:23:55.037983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-06T12:23:55.043194Z","title":"V.; Levine, S.; and Ma, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.043194Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:99957faed1f4dcd688e85c2f42117a501d652392a3c9bb97a644a0e8265df0dd","observation_id":"a5bf6c4d-a3ea-43e3-aaaf-358b2689ce40","resolution":{"observed_at":"2026-08-06T12:23:55.043194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T12:23:55.048401Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.048401Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:9db51fbbcd8c066f46be2c0eb7aaa57cfd08d0918a9a1de2681c76bd2d5420e3","observation_id":"004e29cd-6747-4537-9b98-15ed8151193a","resolution":{"observed_at":"2026-08-06T12:23:55.048401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-06T12:23:55.054695Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.054695Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:10db8303e5de1a2d42fb9b8f63bfd8083828dab5fa3c814b6e53d6a71d664081","observation_id":"667090f5-b2be-4c70-92c3-c4c6f39f9513","resolution":{"observed_at":"2026-08-06T12:23:55.054695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17231","last_updated":"2024-04-03T15:22:35Z","snapshot_observed_at":"2026-08-01T19:29:13.449337Z","submitted_at":"2024-02-27T05:50:35Z","title":"MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17231","snapshot_observed_at":"2026-08-06T12:23:55.060523Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.060523Z"},"links":{"cited_paper":"/paper/2402.17231","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:4a9bf301f8196bc87bee5f20a16568097ead57984d24f0cf6f612094d351505e","observation_id":"723ab1c7-9245-4c8b-bad1-c1a073751a10","resolution":{"observed_at":"2026-08-06T12:23:55.060523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16410","last_updated":"2025-05-22T09:00:19Z","snapshot_observed_at":"2026-08-07T20:42:11.938642Z","submitted_at":"2025-05-22T09:00:19Z","title":"Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16410","snapshot_observed_at":"2026-08-06T12:23:55.066336Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.066336Z"},"links":{"cited_paper":"/paper/2505.16410","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c0cd0a80a5a1efae97322ef69408e90de86cea1004026c8f047a1c745c4af904","observation_id":"61e64d85-0ef9-4e7b-8d37-94c49eb4807c","resolution":{"observed_at":"2026-08-06T12:23:55.066336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.476517Z","title":null,"venue":null,"work_id":"02dd66ff-c1cb-4b06-a8ac-78f9bb8839a2","year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.071475Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:05758862caecd7ceeaf65a796628db34efd557ee3922a1c14a2130e42758834e","observation_id":"722b34d0-45fd-4132-b46f-6e2fefe6d266","resolution":{"observed_at":"2026-08-06T12:23:56.481262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-08-06T12:23:55.076366Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.076366Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:0833493bd9274a0f0e10123fac1a8a1bf517ae45cdcaafb161ed4ef11c21a27a","observation_id":"cd292c23-6eaa-4846-ae2f-6f785941d014","resolution":{"observed_at":"2026-08-06T12:23:55.076366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10160","last_updated":"2025-04-14T12:14:18Z","snapshot_observed_at":"2026-08-07T16:05:55.084744Z","submitted_at":"2025-04-14T12:14:18Z","title":"MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10160","snapshot_observed_at":"2026-08-06T12:23:55.081531Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.081531Z"},"links":{"cited_paper":"/paper/2504.10160","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:e57440d5185024fa23d9a36c413ce812b12aa606f8c212989a0029fe922fde38","observation_id":"506720b2-0c4a-4ad0-8c3c-17e67987324b","resolution":{"observed_at":"2026-08-06T12:23:55.081531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14810","last_updated":"2025-05-25T14:52:51Z","snapshot_observed_at":"2026-08-07T15:27:03.992813Z","submitted_at":"2025-05-20T18:18:01Z","title":"Scaling Reasoning, Losing Control: Evaluating Instruction Following in Large Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14810","snapshot_observed_at":"2026-08-06T12:23:55.086609Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.086609Z"},"links":{"cited_paper":"/paper/2505.14810","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:91d402c449c98f36b7ca51188e6f66a999724cbc399e670ee20bd487cb2726e8","observation_id":"f4143950-2e76-456e-a840-66278d750e9e","resolution":{"observed_at":"2026-08-06T12:23:55.086609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.461601Z","title":null,"venue":null,"work_id":"c13a25a8-202d-4f4c-803e-442e202c1e4b","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.091473Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:6a3db530d5e67b157ef86d66f5360d558cb4fc1c1fef9792034f84e6e538f6ec","observation_id":"c66ce643-c9e4-4bf4-b988-43e83aea6c5d","resolution":{"observed_at":"2026-08-06T12:23:56.466437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17452","last_updated":"2024-02-21T12:59:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:38Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17452","snapshot_observed_at":"2026-08-06T12:23:55.096057Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.096057Z"},"links":{"cited_paper":"/paper/2309.17452","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:a1897e69fe23c16e81628e9ad3492597836f3dd1ba034429964b52813e281c42","observation_id":"1777e045-0a18-4569-bc3d-11b104450a00","resolution":{"observed_at":"2026-08-06T12:23:55.096057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T12:23:55.101180Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.101180Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c3c34cf7ddd901981bc109ea512a4ed8761d4c83bb7a1e5060ab43d48b8f72a6","observation_id":"051459f2-a29c-46cb-b473-9df3b54f74bd","resolution":{"observed_at":"2026-08-06T12:23:55.101180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.446277Z","title":null,"venue":null,"work_id":"9aeae449-96c1-4290-9f48-597d04243d35","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.106630Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:d2b1fefd8550c38f8e88a91032967878250b89429d1555f9c2e57f0d3b7df58e","observation_id":"0cb9e14f-a257-455c-a47d-2bd7111d30a0","resolution":{"observed_at":"2026-08-06T12:23:56.451211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.430355Z","title":null,"venue":null,"work_id":"253a36ac-8c10-486c-ade8-c6cdbb16cd3f","year":2021},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.112461Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:fc644ba480058e72ba0a3f8eba0275325057dbaf1d23d8cea6097c6469af394c","observation_id":"153d75da-1955-4df7-92ee-b8e74148f85e","resolution":{"observed_at":"2026-08-06T12:23:56.435572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.414307Z","title":"D.; Sugawara, S.; and Aizawa, A","venue":null,"work_id":"142ae588-5824-477b-8a0f-d9a645d45297","year":2020},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.117576Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c1cd55542f05b858e8a2dad695a242bbac6f7d84a4dffdc01fac20020766134b","observation_id":"b003dfd8-33e6-4e16-b24e-abcd817e0a4f","resolution":{"observed_at":"2026-08-06T12:23:56.419486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.396695Z","title":"D.; Phan, D.; Dohan, D.; Douglas, S.; Le, T","venue":null,"work_id":"e0ae00fe-af1d-4d44-a590-7018270e43eb","year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.122505Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c8dfb667989cf0aa9d6d6fd0731df2f5b1b86e3947220094174eae2dab1d6225","observation_id":"6c5ed4f8-2840-48dd-ad42-ea2489c879a8","resolution":{"observed_at":"2026-08-06T12:23:56.401669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14234","last_updated":"2025-06-17T06:47:19Z","snapshot_observed_at":"2026-08-08T01:52:09.540838Z","submitted_at":"2025-06-17T06:47:19Z","title":"Xolver: Multi-Agent Reasoning with Holistic Experience Learning Just Like an Olympiad Team","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14234","snapshot_observed_at":"2026-08-06T12:23:55.127390Z","title":"T.; Rahman, S.; Morol, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.127390Z"},"links":{"cited_paper":"/paper/2506.14234","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:e51526e842b3f56669d283fd4659e289ee0b642f3b955508cd0211635bda9742","observation_id":"6c731bc9-f4b8-4805-8e1e-c245c8c2aa3c","resolution":{"observed_at":"2026-08-06T12:23:55.127390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07596","last_updated":"2025-05-12T14:21:57Z","snapshot_observed_at":"2026-08-07T15:47:51.293460Z","submitted_at":"2025-05-12T14:21:57Z","title":"Reinforced Internal-External Knowledge Synergistic Reasoning for Efficient Adaptive Search Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07596","snapshot_observed_at":"2026-08-06T12:23:55.132290Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.132290Z"},"links":{"cited_paper":"/paper/2505.07596","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c0cc676fd373a8b120aac2c06ff6a0b52691794382d47b20bbd98e9102527d6a","observation_id":"62e38eaa-d5a7-4027-b14f-a8ba8a6d8d69","resolution":{"observed_at":"2026-08-06T12:23:55.132290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-06T12:23:55.137421Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.137421Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:5550a223414fc3bb8d6906fa1279cafc1d7491127320a2c65881c1781653f648","observation_id":"0d4d994f-ad08-48cc-8053-f3617a23e119","resolution":{"observed_at":"2026-08-06T12:23:55.137421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.378539Z","title":null,"venue":null,"work_id":"20483fb1-cffd-4c44-b062-59027542a2cf","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.142335Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:957ad899526f56dbb8c63b511365fced09d74268c3dba59d6d2227977477a164","observation_id":"5447aed0-7fdc-43fa-81b1-6cd23b228ad6","resolution":{"observed_at":"2026-08-06T12:23:56.383410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.361959Z","title":null,"venue":null,"work_id":"79125831-0355-4377-b923-217da6d4d286","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.147454Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c02e5c304017090481bda57acbf0fdec13e1a5599d9b130df9fbadfe9afdb87c","observation_id":"05d35a0f-afb0-4399-b1e3-d4cab0135aa1","resolution":{"observed_at":"2026-08-06T12:23:56.367171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.345837Z","title":null,"venue":null,"work_id":"bf96218e-9d15-469e-a541-4edf49b56c5f","year":2019},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.152237Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:bc20cc0c54a8731dea13f7b8a85545c45836b5eaeb8f300ab0406d2da10858ae","observation_id":"38425f2b-6272-4f3d-a5e3-28f7dd2d9507","resolution":{"observed_at":"2026-08-06T12:23:56.350634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-06T12:23:55.157210Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.157210Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:6188b61b522d524c5c8f99de4d2beed90b006bcf6705c7d8818a1ccc7a362ccd","observation_id":"6a646038-8ee4-413d-a456-803f07f20f48","resolution":{"observed_at":"2026-08-06T12:23:55.157210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.328688Z","title":null,"venue":null,"work_id":"c57960c7-ab2c-4452-8299-f569abe6ea28","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.162520Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:adc84cf3cfc1983510d515eb40ee46aa0857e6d3623e8c02c6e99f9299d3bd4e","observation_id":"4074e7f4-6c65-4f28-9f79-343206e695be","resolution":{"observed_at":"2026-08-06T12:23:56.333903Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.311797Z","title":null,"venue":null,"work_id":"f77296db-9b18-4d22-9e65-b512d4d5c127","year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.166741Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:dbdecdd757904244af53851951151e251682eddb608348c611dc0b1d9b996944","observation_id":"9a5097c2-5f06-4905-9075-95d6fb402a0a","resolution":{"observed_at":"2026-08-06T12:23:56.316621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11423","last_updated":"2025-09-02T02:55:17Z","snapshot_observed_at":"2026-08-07T15:44:36.161203Z","submitted_at":"2025-05-16T16:36:00Z","title":"When Thinking Fails: The Pitfalls of Reasoning for Instruction-Following in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11423","snapshot_observed_at":"2026-08-06T12:23:55.171218Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.171218Z"},"links":{"cited_paper":"/paper/2505.11423","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:6d6623d06a7cbf1be47cca3344dab28c11609dcf46f9d829c8074374d55821a1","observation_id":"74af3947-339f-4281-8dfb-911079c03537","resolution":{"observed_at":"2026-08-06T12:23:55.171218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-08-07T20:40:27.882593Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-06T12:23:55.175839Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.175839Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:349dfc2a4b4e83b97e6d9bb62506d157b778c82d994143ced5df314d080ae94a","observation_id":"4c924188-6d0e-4605-9afb-89eb632f15d7","resolution":{"observed_at":"2026-08-06T12:23:55.175839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.295681Z","title":null,"venue":null,"work_id":"40487e14-7a1c-47e4-8fa3-6487ea668382","year":2021},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.180432Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c5066d90842e434388755d28e5b89fc98bd78ae291191cdaf78e7c5e78428ec2","observation_id":"919ad49d-462a-47a8-a599-44f0fcfc8d33","resolution":{"observed_at":"2026-08-06T12:23:56.300788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.279949Z","title":null,"venue":null,"work_id":"48fc5e7d-2db4-4749-aa7c-0b107cded556","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.184726Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:883665c78464c63d988069266dca8dffa9b6488db615e7329fb70a152c9f0076","observation_id":"0528640e-ea62-4b24-9fe0-e14742311a38","resolution":{"observed_at":"2026-08-06T12:23:56.285005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.262129Z","title":null,"venue":null,"work_id":"31cf4512-ac68-48bb-93bb-b21211b4b32c","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.189197Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:ec3b68fb907658ade8830e129f3f1129f18eef55b803703c48549a157e00a2f0","observation_id":"a71d6dd3-a094-4582-b908-a31ccb4c8fee","resolution":{"observed_at":"2026-08-06T12:23:56.267602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.244529Z","title":null,"venue":null,"work_id":"12ce530d-1f92-4291-889c-c1966d103976","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.193451Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:67e208e05d3e6a71c6d8b259d6be7b987418aaa5e5a0900d5e86a1ce86fe7c84","observation_id":"1d714475-8228-49c5-acb7-c2b3f21ecbed","resolution":{"observed_at":"2026-08-06T12:23:56.250233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07773","last_updated":"2025-08-20T12:20:55Z","snapshot_observed_at":"2026-08-07T15:47:47.764911Z","submitted_at":"2025-05-12T17:23:34Z","title":"Agent RL Scaling Law: Agent RL with Spontaneous Code Execution for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07773","snapshot_observed_at":"2026-08-06T12:23:55.198073Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.198073Z"},"links":{"cited_paper":"/paper/2505.07773","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:8d667a853a520f74607e813833655863081e5adc57694c4a7c361885bb3e6354","observation_id":"180f9b04-4a4c-4050-8278-f640fa91051b","resolution":{"observed_at":"2026-08-06T12:23:55.198073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.202714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.202714Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:32dc875baf2900a600471e1bab4b6aa73170605774151f29fddb3d86c1d81374","observation_id":"6f59724b-f410-45ca-86f8-84102e88672e","resolution":{"observed_at":"2026-08-06T12:23:55.202714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-06T12:23:55.207383Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.207383Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:ac08002dbee3520669271b17bc2da0a8600534d344c772b9359bc0aa011e0f83","observation_id":"7a388184-643a-4935-a613-f8e0d224f6b4","resolution":{"observed_at":"2026-08-06T12:23:55.207383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.213635Z","title":null,"venue":null,"work_id":"e0034ff2-3425-4af0-9e6e-91fd5cc036be","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.212112Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:44a56deafb409693fcf59ec6b485085f965e23a732f4a07e64d4ae2ff2d2c4da","observation_id":"d2a83e75-6cef-4e21-8055-4f24690cc144","resolution":{"observed_at":"2026-08-06T12:23:56.219104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.216656Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.216656Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:d7553bfb3efffc594c70fdde1c2e1289dcb71f98d492c9aeacca9b3d78fd79d1","observation_id":"a4ae1eb0-31bc-45d5-b200-cc97b6efef60","resolution":{"observed_at":"2026-08-06T12:23:55.216656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.186125Z","title":"A.; and Lewis, M","venue":null,"work_id":"5c4178da-c98d-4086-9996-17ea66834671","year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.221344Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:0dd36f657d0bb5112e406ab9e7d03801c3edc232917632a4b3dbc538e5b3a873","observation_id":"dcec9936-1e97-4b00-aca9-930e2feb9e69","resolution":{"observed_at":"2026-08-06T12:23:56.191248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.169581Z","title":null,"venue":null,"work_id":"8eb33b0e-e3c6-444c-a31d-1558efb66f5e","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.225783Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:08e24c75904e6ab3b0f38e465e7f3bd0f98f0ff21a1a58d8a160bed8d9d8c839","observation_id":"ded6630f-1569-4a74-8d97-7b33ed584986","resolution":{"observed_at":"2026-08-06T12:23:56.174745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.153368Z","title":null,"venue":null,"work_id":"9dc557be-2887-4c0c-9657-ca63088809c8","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.230434Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:4cccf6c1bf5f5f5c38056c8b8f5f906de1fc8677f67e72878f52035fbc8944c5","observation_id":"9f4d5364-552d-49dd-8964-6fa7027d9c82","resolution":{"observed_at":"2026-08-06T12:23:56.158300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.138248Z","title":null,"venue":null,"work_id":"563beafa-7ae8-4bfc-8648-a22f69f1b22f","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.235001Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:60873e4e75ad82b05f90b3715bd3772cfb7e59fbb89d88d3000fb3fecf3c774f","observation_id":"db7c884a-9ba1-46c0-8ddc-4171e6432d93","resolution":{"observed_at":"2026-08-06T12:23:56.143058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.239596Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.239596Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:7dc80f8a8d5d0a8f89ef6f674f90988574d26781e48099024ea2e04dfeea75a2","observation_id":"14dee0d9-eb93-4f7a-ba8f-46497b18493d","resolution":{"observed_at":"2026-08-06T12:23:55.239596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.244037Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.244037Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:dea14ccce7862e17692b672cf7972dedb232586e6d53017f85b1ab7a17d05a39","observation_id":"4ab36d37-786e-4545-9b60-4a0dd497893a","resolution":{"observed_at":"2026-08-06T12:23:55.244037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T12:23:55.248574Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.248574Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:854c1046d45c20c3ab6e587b9ac701036bcacbd8a5ba0ce4273cd399cba6a771","observation_id":"91440656-8a7c-4351-8cb4-5444c2e6743f","resolution":{"observed_at":"2026-08-06T12:23:55.248574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.101565Z","title":null,"venue":null,"work_id":"ef73e0b1-d721-4558-a7d3-226dd8cb845a","year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.253394Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:46e6c0d13c9c33f45a4198b35536156ba4a24156ba3bf06217c25215711e12be","observation_id":"ec5e9d4d-52de-4882-a99e-3a50f9b73404","resolution":{"observed_at":"2026-08-06T12:23:56.106655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T12:23:55.257750Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.257750Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:a0f6be40719db107417726f30a193b8c121b19f748b044892646d2280a6c6932","observation_id":"75f9ce17-0646-4097-81cc-c9f357540fff","resolution":{"observed_at":"2026-08-06T12:23:55.257750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.262322Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.262322Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:7cfd8475a92b9c0bfb2ca32516894cea77c1fdcc14248a4075fb945b0c51e21f","observation_id":"5dacf8b6-d784-4531-8e85-b9387d26ae5f","resolution":{"observed_at":"2026-08-06T12:23:55.262322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-06T12:23:55.266683Z","title":"X.; Fang, L.; and Wen, J.-R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.266683Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:832b8b59b4d80597fc1740c3e6b96aff801741109d3af9e15381c5d324dbe838","observation_id":"0fb7dae3-9ebc-459a-bbb2-487fe04d0a30","resolution":{"observed_at":"2026-08-06T12:23:55.266683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.076212Z","title":null,"venue":null,"work_id":"6aa4dcb7-c3f1-4fea-8f28-91a6d39d85f7","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.271585Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:2215f23a5d1c6c130f963873c9f47c9642bc02f2c52b1e0e39b766b6cb2029a0","observation_id":"7a829d1d-6953-4abc-9344-af55a7addeb6","resolution":{"observed_at":"2026-08-06T12:23:56.081150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.060526Z","title":null,"venue":null,"work_id":"19400d0a-aea1-4b21-a06b-8a041a936b19","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.275706Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:e20255666f034fef23b1510778478dd8050aa412313f6c3a1bc0471d3e296a2e","observation_id":"930de274-7d92-4bba-afa9-7a90c589e8c4","resolution":{"observed_at":"2026-08-06T12:23:56.065674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.279697Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.279697Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:fe7165f012f668effc8d7ceceddafc716da352e6708b7a761600a53e4c3ddcb8","observation_id":"a227ce7d-db50-46a7-8b24-353e9e43bc3a","resolution":{"observed_at":"2026-08-06T12:23:55.279697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.029413Z","title":null,"venue":null,"work_id":"3fcf87a2-67ab-466a-837b-286dbe8d4f5f","year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.283718Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:838230530c082584fef6b1d8132d04400ad6e2c25d76de93a79fa50976b05fbf","observation_id":"3977e03d-20a8-4cd6-8f54-dbbbe0ecf6d9","resolution":{"observed_at":"2026-08-06T12:23:56.035175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:56.011686Z","title":null,"venue":null,"work_id":"2f1f64e3-75fb-48f3-8768-a9cad960782f","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.288398Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:84f546d77902ba437a03e69be2e93d63777965e15c49b09ab5c5e0422d67afc4","observation_id":"87884ee7-f47c-4fa4-820c-7f8c3f3aabc9","resolution":{"observed_at":"2026-08-06T12:23:56.016815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.994358Z","title":null,"venue":null,"work_id":"204a7ab5-253d-45b0-bcd2-84a2c5df1578","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.292695Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:3dec472409381dd9c07f3362d88bfb3ccaaaaec865c48fbe3d950d9a627642bb","observation_id":"0fd5e305-96e1-4806-8b5f-7d0512d9a7ac","resolution":{"observed_at":"2026-08-06T12:23:55.999918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03533","last_updated":"2024-02-22T06:21:51Z","snapshot_observed_at":"2026-07-06T14:27:46.217000Z","submitted_at":"2022-12-07T09:25:54Z","title":"Text Embeddings by Weakly-Supervised Contrastive Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03533","snapshot_observed_at":"2026-08-06T12:23:55.296956Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.296956Z"},"links":{"cited_paper":"/paper/2212.03533","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:1d84624f969a24d32c621949c8e3e98b0a79e59e2ded7725d068186009e31d11","observation_id":"6dd7b948-b9de-43da-ab64-09920117af32","resolution":{"observed_at":"2026-08-06T12:23:55.296956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05157","last_updated":"2023-10-08T13:19:52Z","snapshot_observed_at":"2026-07-06T16:29:27.783330Z","submitted_at":"2023-10-08T13:19:52Z","title":"MenatQA: A New Dataset for Testing the Temporal Comprehension and Reasoning Abilities of Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.05157","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05157","snapshot_observed_at":"2026-08-06T12:23:55.494550Z","title":"MenatQA: A New Dataset for Testing the Temporal Comprehension and Reasoning Abilities of Large Language Models","venue":"cs.CL","work_id":"fbb9469c-1f27-4d6a-bd70-06b83fecea65","year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.301646Z"},"links":{"cited_paper":"/paper/2310.05157","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c21bcbcee3b10b88a657aa3a56e66b67d650edc3c192b6149e578a46566d422b","observation_id":"2169dfa0-4492-4921-b001-ead51af07151","resolution":{"observed_at":"2026-08-06T12:23:55.500019Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07184","last_updated":"2025-05-12T02:21:36Z","snapshot_observed_at":"2026-08-07T15:48:01.254751Z","submitted_at":"2025-05-12T02:21:36Z","title":"Structural Entropy Guided Agent for Detecting and Repairing Knowledge Deficiencies in LLMs","version":1},"cited_work":{"arxiv_id":"2505.07184","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07184","snapshot_observed_at":"2026-08-06T12:23:55.469609Z","title":"Structural Entropy Guided Agent for Detecting and Repairing Knowledge Deficiencies in LLMs","venue":"cs.CL","work_id":"a7c323c1-99f4-400b-9a8f-f25105ff27f7","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.307048Z"},"links":{"cited_paper":"/paper/2505.07184","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:52746ce60182aacc689331936554f9840f5c4ccf97abc934ada0c8bc4215a3be","observation_id":"deb46779-f24f-42fa-8baa-c1861eaf09da","resolution":{"observed_at":"2026-08-06T12:23:55.477185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.978969Z","title":null,"venue":null,"work_id":"b2bb3dc8-5e38-48cc-a4af-de56ae53e10e","year":2024},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.311727Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:703568226af723e9cb691bb596f803617bbe12cb02f840e6f9eb6774fb81e610","observation_id":"9c056e49-0b23-4e46-84e5-0772bcc0b99f","resolution":{"observed_at":"2026-08-06T12:23:55.983520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.963002Z","title":null,"venue":null,"work_id":"ae5dee10-a3e0-4192-a4b9-c075c689dc54","year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.316038Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:ba5ace8cdeb4e3475a6293f92f2f8869fcf0bfd254cc854aa677c17225715fac","observation_id":"b6dce6f5-72b0-4a74-9bc9-a36e24b926d2","resolution":{"observed_at":"2026-08-06T12:23:55.968767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.947191Z","title":null,"venue":null,"work_id":"9694cecc-dcf6-4b03-bdb9-0b37eec20832","year":2018},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.320345Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:c62ce5d3c62beb0565cf66125df7beb2508740ada57f73982670fd7a27896e15","observation_id":"79dfff32-e5a3-4db3-b580-4d25e33b316a","resolution":{"observed_at":"2026-08-06T12:23:55.952044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.324339Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.324339Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:5c17e71cac23ac04c997bf2555f53f1f6d7c4215fcea7aff4f7500d864605b07","observation_id":"a2a71f0e-8640-4bf5-9bea-2f4fa965e8aa","resolution":{"observed_at":"2026-08-06T12:23:55.324339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.921202Z","title":null,"venue":null,"work_id":"04784576-8005-44eb-8518-60b908237392","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.328625Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:cf2bba6ae85c19e4874301931193f1c53533d9350cf0d248b8f4d112037dc77d","observation_id":"bfd1390e-235f-4271-b985-235d5a08d6d6","resolution":{"observed_at":"2026-08-06T12:23:55.926226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.905698Z","title":"C.; Kaddar, Y.; Blunsom, P.; Staton, S.; and Gal, Y","venue":null,"work_id":"e4cfb939-6143-44de-bccc-142092694050","year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.332803Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:deea1766690247048d2c37ee3f96123bc1179fea37bb549491c2503f40413aa9","observation_id":"512c3165-da91-4b50-ae51-162ed3e576f1","resolution":{"observed_at":"2026-08-06T12:23:55.910593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T12:23:55.337141Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.337141Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:8857e35781eeb55abb6a596a5a4aeb4b7359b584fccd912d1f4aa4f9f08a6d45","observation_id":"681164e1-4561-4ded-87fc-f8956956aa80","resolution":{"observed_at":"2026-08-06T12:23:55.337141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.342076Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.342076Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:f951fcfd8e57d4c99ee2458fedebf3ff36761e52e6ad513d652a6e0d0dfadcd7","observation_id":"9af55f1e-16aa-4fac-8920-52e7930facdb","resolution":{"observed_at":"2026-08-06T12:23:55.342076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-06T12:23:55.346347Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.346347Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:0ac5a33a2b14227c229ddf2e63da50bded3d95f3bf1cd9f8dadafc2fe9e72483","observation_id":"c36f7776-b63e-49e8-9354-a906a54ca132","resolution":{"observed_at":"2026-08-06T12:23:55.346347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-06T12:23:55.351954Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.351954Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:4667c1fd927ef167c63bcf0b5e84b0c8d0f17603c1fb854c6e3810e5fef01a46","observation_id":"7c79cf1b-5bcc-4831-a59e-0453df71363e","resolution":{"observed_at":"2026-08-06T12:23:55.351954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15841","last_updated":"2025-07-17T08:53:48Z","snapshot_observed_at":"2026-08-04T10:58:41.179508Z","submitted_at":"2025-06-18T19:44:46Z","title":"MEM1: Learning to Synergize Memory and Reasoning for Efficient Long-Horizon Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15841","snapshot_observed_at":"2026-08-06T12:23:55.356601Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.356601Z"},"links":{"cited_paper":"/paper/2506.15841","citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:a9a76e512005f40055752734aac8debe35262c78d817fa305b781cbf3e5e8286","observation_id":"9d1213f1-8b9f-4d62-8751-4accbfd81558","resolution":{"observed_at":"2026-08-06T12:23:55.356601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.361388Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.361388Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:e42f6926d33856a53b4fc28312f165c51487562304ce521073946829b38f5dfa","observation_id":"81019d0f-7131-47a8-a919-75900c09714b","resolution":{"observed_at":"2026-08-06T12:23:55.361388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:23:55.366230Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T12:23:55.366230Z"},"links":{"citing_paper":"/paper/2507.21836"},"observation_digest":"sha256:235a55f46feefc514a313ee1feb759aa3ea8e9b2a850eeabe27f78d41dd03b92","observation_id":"dab0f0fa-d2db-4448-9f87-dabbe20ebe69","resolution":{"observed_at":"2026-08-06T12:23:55.366230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.21836","last_updated":"2025-07-29T14:12:28Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T20:39:44.012130Z","submitted_at":"2025-07-29T14:12:28Z","title":"AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":2,"verified_fuzzy":5},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 15 inbound Pith citation observations for arXiv:2507.21836."}