{"as_of":"2026-08-07T17:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b23010e2123da787987b856a7abf27dc8c3e80d2a1ddd11fcfd5eae96669e9a","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:10:04.649930Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T21:54:13.090019Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T09:46:01.011609Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04518","snapshot_observed_at":"2026-07-12T21:54:13.090019Z","title":"Shishir G Patil, Huanzhi Mao, Fanjia Yan, Char- lie Cheng-Jie Ji, Vishnu Suresh, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.11556","last_updated":"2026-06-18T16:56:08Z","snapshot_observed_at":"2026-08-05T05:03:09.113194Z","submitted_at":"2026-04-13T14:42:44Z","title":"FM-Agent: Scaling Formal Methods to Large Systems via LLM-Based Hoare-Style Reasoning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T21:54:13.090019Z"},"links":{"cited_paper":"/paper/2509.04518","citing_paper":"/paper/2604.11556"},"observation_digest":"sha256:2c9f771fc5a998105c860eb876154866cc2daf695dee7e516475243c3cc9199b","observation_id":"d9bff33a-e35d-4524-9579-123ad546bf1d","resolution":{"observed_at":"2026-07-12T21:54:13.090019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.04518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04518","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shishir G Patil, Huanzhi Mao, Fanjia Yan, Char- lie Cheng-Jie Ji, Vishnu Suresh, Ion Stoica, and Joseph E","venue":null,"work_id":"c715bdd2-1bf0-497d-9ea8-6dff55ce2f41","year":2025},"citing_paper":{"arxiv_id":"2604.11557","last_updated":"2026-05-25T09:56:37Z","snapshot_observed_at":"2026-07-12T21:53:43.487652Z","submitted_at":"2026-04-13T14:43:47Z","title":"UniToolCall: Unifying Tool-Use Representation, Data, and Evaluation for LLM Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:51:22.508030Z"},"links":{"cited_paper":"/paper/2509.04518","citing_paper":"/paper/2604.11557"},"observation_digest":"sha256:2144bbd162543bea506e36cd5843e2127563a07f89964472d96def2bd8b8dc7c","observation_id":"2a4dd6d6-a61a-4d34-8ed9-cecbef6a54d1","resolution":{"observed_at":"2026-05-11T09:46:01.014476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.04518/citation-record","integrity":"/paper/2509.04518/integrity","json":"/paper/2509.04518/citation-record.json","paper":"/paper/2509.04518"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.969857Z","title":"xLAM: A Family of Large Action Models to Empower AI Agent Systems","venue":null,"work_id":"68f596eb-397a-42ff-8432-c195344beaea","year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:00.978776Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:cec0abcb57f06d52fcaa5107041cd6b992530b8af564934f78e97e5a6f1be344","observation_id":"5a739158-c700-47d6-b97c-2a8a6e6ee523","resolution":{"observed_at":"2026-08-05T11:10:05.975207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15790","last_updated":"2025-02-26T06:34:55Z","snapshot_observed_at":"2026-08-04T07:43:40.230682Z","submitted_at":"2024-09-24T06:36:56Z","title":"Small Language Models: Survey, Measurements, and Insights","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15790","snapshot_observed_at":"2026-08-05T11:10:01.164458Z","title":"Small Language Models: Survey, Measurements, and Insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:01.164458Z"},"links":{"cited_paper":"/paper/2409.15790","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:d8747c0845eda62254c0100dd0d1a8f2036c95e33014df6bcfbc2b404dd7a83f","observation_id":"acdecbb0-7f67-498e-96ff-6bdf79cb8cb7","resolution":{"observed_at":"2026-08-05T11:10:01.164458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03350","last_updated":"2024-12-28T09:18:36Z","snapshot_observed_at":"2026-08-04T03:34:32.259687Z","submitted_at":"2024-11-04T04:43:01Z","title":"A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03350","snapshot_observed_at":"2026-08-05T11:10:01.491388Z","title":"A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:01.491388Z"},"links":{"cited_paper":"/paper/2411.03350","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:bb702386cbc9029617432c141930729c87b68270aa7ef37cfd5b3164ae60163e","observation_id":"d8591ed5-cdcf-4658-9f78-2a8da7684f8a","resolution":{"observed_at":"2026-08-05T11:10:01.491388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20011","last_updated":"2024-10-25T23:52:28Z","snapshot_observed_at":"2026-08-01T23:27:59.038399Z","submitted_at":"2024-10-25T23:52:28Z","title":"A Survey of Small Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20011","snapshot_observed_at":"2026-08-05T11:10:01.962412Z","title":"A Survey of Small Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:01.962412Z"},"links":{"cited_paper":"/paper/2410.20011","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:17c9838e4ac711dcf803b790ecea2d0bad68f201eb8529d317f5d69128322bb5","observation_id":"0d357488-fbff-48f6-8760-0e1d122f737d","resolution":{"observed_at":"2026-08-05T11:10:01.962412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:02.412340Z","title":"A Survey on Large Language Model Based Autonomous Agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:02.412340Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:82b128288a75cde925151ecdd1f7a3ca0b557a3faa4bfcf3c3660f4032dba71d","observation_id":"314604c8-6f0a-4502-825b-62a61616c468","resolution":{"observed_at":"2026-08-05T11:10:02.412340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.953115Z","title":"Report on a General Problem-Solving Program,","venue":null,"work_id":"e41f9a96-cdba-4bd6-8564-45f81647e8e1","year":1959},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:02.945525Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:6e934b6e43d2a3bfe414492932e5cb29fa909fe4b0d81bea7e5c720453cb38b2","observation_id":"9d0408b0-35b3-4889-bd7b-9c50d71362c5","resolution":{"observed_at":"2026-08-05T11:10:05.958735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/367177","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:04.888768Z","title":"Recursive Functions of Symbolic Expressions and Their Computation by Machine, Part I,","venue":null,"work_id":"ef6f842e-1ae4-466a-85b5-74f7485ede55","year":1960},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.110076Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:030995942958c245f17fd402013fd57f8ff4673bf00c6a287e4e5c6c6ed5e352","observation_id":"19602187-4f0b-43b8-8617-5db64f913ecd","resolution":{"observed_at":"2026-08-05T11:10:04.939574Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.937155Z","title":"Language Models are Unsupervised Multitask Learners,","venue":null,"work_id":"041048a3-715f-4f84-85f6-0beb0a04846f","year":2019},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.208256Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:bd93f2fc7dd6788b0c308be8e6b45cabd2624ccd572ae0eb6b00f4d5916892f1","observation_id":"02c4f326-0cbf-45c8-938c-23847ffc2f9e","resolution":{"observed_at":"2026-08-05T11:10:05.942175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.12914","last_updated":"2019-12-30T13:08:12Z","snapshot_observed_at":"2026-07-06T08:47:37.114560Z","submitted_at":"2019-12-30T13:08:12Z","title":"'Alexa, Do You Know Anything?' The Impact of an Intelligent Assistant on Team Interactions and Creative Performance Under Time Scarcity","version":1},"cited_work":{"arxiv_id":"1912.12914","doi":"10.48550/arxiv.1912.12914","metadata_source":"pith","pith_arxiv_id":"1912.12914","snapshot_observed_at":"2026-08-05T12:16:14.913508Z","title":"'Alexa, Do You Know Anything?' The Impact of an Intelligent Assistant on Team Interactions and Creative Performance Under Time Scarcity","venue":"cs.HC","work_id":"cef49573-7fb1-42d0-969d-c8909deb592d","year":2019},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.295382Z"},"links":{"cited_paper":"/paper/1912.12914","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:830317dc4a7cdedf930ff164f44c92f4ecef8846134a6db5c771ad6452bcb2d6","observation_id":"a587a32d-68ca-43e2-bd58-4e71eeeb6eca","resolution":{"observed_at":"2026-08-05T11:10:04.877547Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:03.382282Z","title":"End-to- End Autonomous Driving: Challenges and Frontiers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.382282Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:1df013bb14de55dade63d8eda8824d4d27fc11df912f10360d08e16e52a8827b","observation_id":"ed528a00-fba9-4f79-a27f-f7dfd58408f4","resolution":{"observed_at":"2026-08-05T11:10:03.382282Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01502","last_updated":"2024-07-01T17:48:14Z","snapshot_observed_at":"2026-08-06T22:15:08.500389Z","submitted_at":"2024-07-01T17:48:14Z","title":"AI Agents That Matter","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01502","snapshot_observed_at":"2026-08-05T11:10:03.458069Z","title":"AI Agents That Matter,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.458069Z"},"links":{"cited_paper":"/paper/2407.01502","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:572f766da8467b2799a1ac88675a6a357ff3741c746c9938600936e05c956e00","observation_id":"b35464ff-239f-42da-98bb-40e31cecb7a8","resolution":{"observed_at":"2026-08-05T11:10:03.458069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.880426Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools,","venue":null,"work_id":"2487105d-c91b-4484-8e03-5138d1a97fa8","year":2023},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.567181Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:52c9fb8586a7731d25bcfb154440bb183637092daa60d8384f910e16dbe4a13a","observation_id":"b766be02-3661-4252-b449-f14034bf437b","resolution":{"observed_at":"2026-08-05T11:10:05.921779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.736326Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs,","venue":null,"work_id":"c0dbe5fe-fdc7-4b78-9191-4dc0ce48b90b","year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.642778Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:3a1e5fc9ccbb37bab71c6ae5745175b844bf652a2efef1c62cb1647888abdf43","observation_id":"4ccdd332-9f88-4cd7-8a73-524320bf1074","resolution":{"observed_at":"2026-08-05T11:10:05.801284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.582818Z","title":"Training Language Models to Follow Instructions with Human Feedback,","venue":null,"work_id":"8c82586b-958d-4430-b744-d4ba67349db2","year":2022},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.751242Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:34e08524f3a2d26e295e05d1856ea25f69a27ec60b173c77eac416e549ab9741","observation_id":"03d53b38-d8a9-4db5-a503-f4de6e79841b","resolution":{"observed_at":"2026-08-05T11:10:05.645364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.459835Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models,","venue":null,"work_id":"44690bec-d60a-4bb8-9997-90abbec423e1","year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.843310Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:7a992d2bc56ee7e20c2ec8551e4a0f4518dc6cf3948fcabacddfd101e3291141","observation_id":"e4e28a8d-eeef-49f0-9ab0-e02b5a725ad6","resolution":{"observed_at":"2026-08-05T11:10:05.517883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T11:10:04.079194Z","title":"DeepSeek-R1: Incen- tivizing Reasoning Capability in LLMs via Reinforcement Learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.079194Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:61f514afbb0603645e02b388d11210043c37471f3640042b7ee6a2d342254018","observation_id":"ef53e933-8bd7-439b-86a5-6e4b5a864c74","resolution":{"observed_at":"2026-08-05T11:10:04.079194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T11:10:04.188526Z","title":"Proximal Policy Optimization Algorithms,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.188526Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:9cbf727663b8266029c105a9264440c177464ea02d8f27618897cbe492537585","observation_id":"d523fb7a-35c5-448f-a7e1-2b1709459da8","resolution":{"observed_at":"2026-08-05T11:10:04.188526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.279791Z","title":"TinyAgent: Function Calling at the Edge,","venue":null,"work_id":"f53661e7-5ed9-4ce5-b225-54df207f5e3d","year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.304885Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:34fabc5961967bc90a2af55fd8533def927ad465d184d92276371ccdf22fffda","observation_id":"831b30e6-4e91-4df4-aca9-717956e41689","resolution":{"observed_at":"2026-08-05T11:10:05.333086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18890","last_updated":"2024-10-24T16:27:35Z","snapshot_observed_at":"2026-08-06T04:16:49.356443Z","submitted_at":"2024-10-24T16:27:35Z","title":"Improving Small-Scale Large Language Models Function Calling for Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18890","snapshot_observed_at":"2026-08-05T11:10:04.397873Z","title":"Improving Small-Scale Large Language Models Function Calling for Reasoning Tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.397873Z"},"links":{"cited_paper":"/paper/2410.18890","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:3dbc6a2c636adfcbc242e1078466ccde81b44f8f99a13589aeac6f19cdded47e","observation_id":"535412ba-ab79-4f6c-bc3f-16386e6dc8a0","resolution":{"observed_at":"2026-08-05T11:10:04.397873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T11:10:04.469320Z","title":"Qwen2.5 Technical Report,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.469320Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:7bbaecd17825226fe6e97e153da7236f329bf1f33fc9a699f1a51bd8c9b43b33","observation_id":"66a8bba0-6122-44f4-ad60-afb7355bb878","resolution":{"observed_at":"2026-08-05T11:10:04.469320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T11:10:04.649930Z","title":"LLaMA: Open and Efficient Foundation Lan- guage Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.649930Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:49402d62c713dc89cdc2baf72f0f366f7a48e917c41209f5c11a2d2cb73b86a3","observation_id":"957abe72-1b9f-4cc3-9c9b-aee939aa7add","resolution":{"observed_at":"2026-08-05T11:10:04.649930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T11:10:04.581497Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.581497Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:c7acca67db640d71b4187c3fddd0dde4dc52cc9b4650f00dce6cf9b8e470716a","observation_id":"f7d9ffda-4c03-4d16-84f1-3a92e51592c7","resolution":{"observed_at":"2026-08-05T11:10:04.581497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.406179Z","title":null,"venue":null,"work_id":"e4e86cc4-7989-4135-ab0e-46900b0d1405","year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.202015Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:9e4d5c0fce66bfb4ca340b75add73a28f28609e1c1621deefec931690975fa17","observation_id":"6f424498-7f7b-437d-862b-b2486113aa2b","resolution":{"observed_at":"2026-08-05T11:10:05.411430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T11:10:03.953925Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.953925Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:077331e0171a6ebb5c6edceb8c21ac66f04b92d7d02e6d0161f30ac2acad733e","observation_id":"5a58ba46-ed0d-4905-b6b0-141cc59415d8","resolution":{"observed_at":"2026-08-05T11:10:03.953925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T23:46:53.458717Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":8},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 2 inbound Pith citation observations for arXiv:2509.04518."}