{"as_of":"2026-08-06T21:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f9618618adba65dcc970744f7cd84e0593c979ebb38561ab8f31fe6bfaf707e","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T06:30:39.858246Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T09:13:20.071265Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"cited_work":{"arxiv_id":"2510.14703","doi":"10.48550/arxiv.2510.14703","metadata_source":"pith","pith_arxiv_id":"2510.14703","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","venue":"cs.AI","work_id":"473b0276-af7f-41e0-8683-212f4d7ddff0","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-02T16:58:42.709299Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T03:47:34.897401Z"},"links":{"cited_paper":"/paper/2510.14703","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:2f19544b6c2bc5d76e7169169d9577441886e0e199a50283dd88a36e9ffdadfc","observation_id":"83c41822-8327-4208-a293-820c1f09cced","resolution":{"observed_at":"2026-05-09T00:19:26.296482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"cited_work":{"arxiv_id":"2510.14703","doi":"10.48550/arxiv.2510.14703","metadata_source":"pith","pith_arxiv_id":"2510.14703","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","venue":"cs.AI","work_id":"473b0276-af7f-41e0-8683-212f4d7ddff0","year":2025},"citing_paper":{"arxiv_id":"2604.24198","last_updated":"2026-06-20T11:27:04Z","snapshot_observed_at":"2026-08-02T16:58:42.709299Z","submitted_at":"2026-04-27T09:00:30Z","title":"Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-01T09:13:20.071265Z"},"links":{"cited_paper":"/paper/2510.14703","citing_paper":"/paper/2604.24198"},"observation_digest":"sha256:610fb1c65c6897e09cdc9dc00c7956b8f2bea681ef04e82bcfbbec38e89f8b19","observation_id":"57300735-99e4-4ec8-b789-8bae6a35cfa7","resolution":{"observed_at":"2026-07-01T09:15:42.750478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.14703/citation-record","integrity":"/paper/2510.14703/integrity","json":"/paper/2510.14703/citation-record.json","paper":"/paper/2510.14703"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.00121","last_updated":"2024-06-27T17:47:26Z","snapshot_observed_at":"2026-07-06T18:38:42.333605Z","submitted_at":"2024-06-27T17:47:26Z","title":"Granite-Function Calling Model: Introducing Function Calling Abilities via Multi-task Learning of Granular Tasks","version":1},"cited_work":{"arxiv_id":"2407.00121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.00121","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OWASP Foundation","venue":null,"work_id":"edc15fce-3917-4a59-a74d-94c7880fc5d0","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2407.00121","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:8b282dc13912721eb228feaa37afb70b317e6b5dc89b7b34367e883fe41f10b8","observation_id":"eab48532-235f-4542-9644-1d5b533f0ad1","resolution":{"observed_at":"2026-05-18T06:30:59.502641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ackley, Geoffrey E","venue":null,"work_id":"4a622e21-890e-4356-bbe2-adf77a6adf93","year":1985},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:a578ac40d042152fdc36e93cef2db5e5f6dbc8e3a0042b9e9f2c9dc317d0471b","observation_id":"f4d25d7c-9cec-4315-868f-8b7d7c4f6580","resolution":{"observed_at":"2026-05-18T06:30:59.789592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00294","last_updated":"2025-03-31T23:40:28Z","snapshot_observed_at":"2026-08-04T13:19:45.872454Z","submitted_at":"2025-03-31T23:40:28Z","title":"Inference-Time Scaling for Complex Tasks: Where We Stand and What Lies Ahead","version":1},"cited_work":{"arxiv_id":"2504.00294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00294","snapshot_observed_at":"2026-07-01T09:05:37.594479Z","title":"Inference-time scaling for complex tasks: Where we stand and what lies ahead","venue":null,"work_id":"f3ff70b3-3801-4176-9fd9-a2e3efa65daf","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2504.00294","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:e952de274fe83298d443e2b3544dc44ea765692069459f7e63f13806ac2f8d25","observation_id":"f27b7b71-50ab-4789-8a12-7a4ddbbe564b","resolution":{"observed_at":"2026-05-18T06:30:59.508056Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03797","last_updated":"2025-05-21T04:36:42Z","snapshot_observed_at":"2026-07-06T19:11:14.114279Z","submitted_at":"2024-09-04T17:53:24Z","title":"NESTFUL: A Benchmark for Evaluating LLMs on Nested Sequences of API Calls","version":3},"cited_work":{"arxiv_id":"2409.03797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03797","snapshot_observed_at":"2026-07-02T03:36:29.696220Z","title":"Nestful: Abenchmark for evaluating llms on nested sequences of api calls","venue":null,"work_id":"53f95caf-1007-46ac-b1af-73921fadaf8e","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2409.03797","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:d34773e9404fdfbd30551d051605d2e8e11a636cabd9bdf0d5a180e8735534bb","observation_id":"91a285a0-ab89-412b-9e4c-467a7bfe332a","resolution":{"observed_at":"2026-05-18T06:30:59.514386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:bc100231603d3dea3dd57d9bc8a14a3428775c319cf665e56e34691d529d4839","observation_id":"2f60fb71-058a-46b4-b824-08f01e08b757","resolution":{"observed_at":"2026-05-18T06:30:59.534435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T13:11:06.620017Z","title":null,"venue":null,"work_id":"6e5fbff2-00cb-473e-9804-4d83c8544520","year":2020},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:ecf122066217b1d0c9ba6bb5d92551b9843a6e375b1f39e34707199a1ab48178","observation_id":"6d9fcc02-57a1-4437-9b4f-f1ad13dd604f","resolution":{"observed_at":"2026-05-18T06:30:59.818372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01549","last_updated":"2026-07-20T02:25:24Z","snapshot_observed_at":"2026-07-23T23:19:57.929719Z","submitted_at":"2024-04-02T01:29:28Z","title":"Octopus: On-device language model for function calling of software APIs","version":2},"cited_work":{"arxiv_id":"2404.01549","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.01549","snapshot_observed_at":"2026-07-21T01:21:38.414887Z","title":null,"venue":null,"work_id":"33e038e2-cee5-45aa-a310-526b56a71ef1","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2404.01549","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:9cce90bd84d58b3e3984499966dda66d40ffefb80f7c2ef9e4dac7af7e14f128","observation_id":"737bcdc0-ed6c-41fd-bfdd-abd7979ed6b2","resolution":{"observed_at":"2026-07-21T01:21:38.414887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09044","last_updated":"2023-10-13T12:12:34Z","snapshot_observed_at":"2026-07-06T16:32:27.303662Z","submitted_at":"2023-10-13T12:12:34Z","title":"KCTS: Knowledge-Constrained Tree Search Decoding with Token-Level Hallucination Detection","version":1},"cited_work":{"arxiv_id":"2310.09044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.09044","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2310.09044 , year=","venue":null,"work_id":"34dbcc24-495a-4b97-a5c8-afa22f24964d","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2310.09044","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:48c87971a065a325fb5cab0f87f62664de195734913baf7e19cd3ec2ab8d781e","observation_id":"ef31c2d1-1217-489e-a7a9-47c4086446da","resolution":{"observed_at":"2026-05-18T06:30:59.657416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:45:27.558250Z","title":null,"venue":null,"work_id":"7e7dc025-2070-4919-b779-b3aad9a11853","year":2019},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:0c8e95be096e985726a0e8dc83ad15ba2aa6fb8fc461256690cea1d3c6f268db","observation_id":"af89acfc-bba7-486e-9973-7c4bde34a90e","resolution":{"observed_at":"2026-05-18T06:30:59.815106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00608","last_updated":"2024-10-25T01:16:55Z","snapshot_observed_at":"2026-07-06T19:08:48.648862Z","submitted_at":"2024-09-01T04:23:48Z","title":"TinyAgent: Function Calling at the Edge","version":3},"cited_work":{"arxiv_id":"2409.00608","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.00608","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"E., Lee, N., Jha, S., Kim, S., Tabrizi, R., Moon, S., Hooper, C., Anumanchipalli, G., Keutzer, K., and Gholami, A","venue":null,"work_id":"cb7a8776-c507-490d-bef3-1b3be9936552","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2409.00608","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:d49f2a3a7156c19cfba0bc1d8c4061e41303af5f1cea7ed26ba02611cd0c057c","observation_id":"b1f85dda-d33c-4bae-aec5-78b73e35bfc9","resolution":{"observed_at":"2026-05-18T06:30:59.634603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:cd1622e2753d259912eaecd7279787c8b6a183309718f54f71ef14c6a9d1a392","observation_id":"0a31514b-d326-4f6c-b069-215fec1cc7ce","resolution":{"observed_at":"2026-05-18T06:30:59.649935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"70b0fbe5-42f1-4521-9d4b-5ac0833c8832","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:ddf977101623e2aa1c81deba1505c5c5879b9f696d5b467c1c2326df7a1f1cde","observation_id":"f21ca3d1-e615-4e6b-98be-56439d655977","resolution":{"observed_at":"2026-05-18T06:30:59.802470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:0f72b2da5b29f12b5ddf79bce7c85e895e2104186cf7d81b08ac6a6c0284a6e5","observation_id":"16fb6197-3ea0-4612-8dd3-60ca0aa6d74e","resolution":{"observed_at":"2026-05-18T06:30:59.615965Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:e2cf2914d7d6dde743e797b6d80f2121f671fc84439dc347a9330610e1efcc62","observation_id":"ea5657e4-cf9a-4072-be09-6460b67af350","resolution":{"observed_at":"2026-05-18T06:30:59.564079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.09037","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:09:45.122164Z","title":"https://arxiv.org/abs/2504.09037","venue":null,"work_id":"32641395-8df2-4b21-8453-77b7160420fd","year":2026},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:468732a44238114bb55771befa60cc9326c0a669cab839e37ac8cd8cdc2e5c20","observation_id":"f0fe6994-0172-458c-b44e-1b7ad6222982","resolution":{"observed_at":"2026-05-18T06:30:59.593183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:24:55.270950Z","title":null,"venue":null,"work_id":"f754c199-1a35-4607-b707-bef186103f53","year":2022},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:d675c923757ebf3334a24a3bd11d2e65cadccdd117f54732652b6811b4e7ae0c","observation_id":"c90a6225-d28a-4797-a8e0-1753d59d3517","resolution":{"observed_at":"2026-05-18T06:30:59.808682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08244","last_updated":"2023-10-25T06:54:12Z","snapshot_observed_at":"2026-08-02T00:07:12.855748Z","submitted_at":"2023-04-14T14:05:32Z","title":"API-Bank: A Comprehensive Benchmark for Tool-Augmented LLMs","version":2},"cited_work":{"arxiv_id":"2304.08244","doi":"10.48550/arxiv.2304.08244","metadata_source":"pith","pith_arxiv_id":"2304.08244","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"API-Bank: A Comprehensive Benchmark for Tool-Augmented LLMs","venue":"cs.CL","work_id":"a20d9332-ab34-485c-a060-1ba47cc98930","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2304.08244","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:bf21b1bd11b174eef293e2094cf202c7783b4970c2b15fa33e8f490df2bc4b59","observation_id":"779cdcf4-e961-4759-9f23-5a1a1158c2f8","resolution":{"observed_at":"2026-05-18T06:30:59.574221Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:23.914543+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:23.914543+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T03:24:29.241250Z","title":null,"venue":null,"work_id":"54f39840-3704-4221-85ac-53ff109310c8","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:2a66e5ad8cead09358809249d36b0bae2611bddf57728fc4d227a6dbf46b27e7","observation_id":"9d3a3478-a79e-4ecb-960d-875b2831ef71","resolution":{"observed_at":"2026-05-18T06:30:59.828459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ae9b5265-f79c-43e5-8a7a-9a5f09d85f71","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:6e8346e3be092b3be7c7a572e8e507962002373e1a97c171d8c894cf356190bb","observation_id":"6f4d256d-a49d-4013-92d5-b41316534c07","resolution":{"observed_at":"2026-05-18T06:30:59.792924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.04587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T01:17:30.719460Z","title":"Hammer: Robust function-calling for on-device language models via function masking","venue":null,"work_id":"82d3fcb9-d6f7-4e5c-a7c8-998273bded68","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:c4a50fa3f64178518b992b3b75616148f79418a585fc9baabb1b2c9e6fee726a","observation_id":"7d7742cc-9325-4c7f-a766-ef7bd69965a9","resolution":{"observed_at":"2026-05-18T06:30:59.545114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15028","last_updated":"2024-04-02T17:51:49Z","snapshot_observed_at":"2026-07-06T16:23:53.247204Z","submitted_at":"2023-09-26T15:57:57Z","title":"Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding","version":3},"cited_work":{"arxiv_id":"2309.15028","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.15028","snapshot_observed_at":"2026-06-29T18:33:51.103900Z","title":"Don’t throw away your value model! Generating more preferable text with value-guided monte-carlo tree search decoding","venue":null,"work_id":"f2e0a04c-ce8e-48d8-a630-eef90d2e0839","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2309.15028","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:82dc1e32348f91323a911f331bb7532a93966e3887f704927624e337bdf1c54d","observation_id":"82d4ed90-25fe-41ff-b92d-6be482e39f85","resolution":{"observed_at":"2026-05-18T06:30:59.638653Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00920","last_updated":"2025-07-25T08:26:54Z","snapshot_observed_at":"2026-07-06T19:09:01.748727Z","submitted_at":"2024-09-02T03:19:56Z","title":"ToolACE: Winning the Points of LLM Function Calling","version":2},"cited_work":{"arxiv_id":"2409.00920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.00920","snapshot_observed_at":"2026-07-05T04:40:40.695053Z","title":"ToolACE : Winning the points of LLM function calling","venue":null,"work_id":"1186dcff-a8d4-4766-84c4-1cda266a9852","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2409.00920","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:f7d7701718782c923da4c3bb79a6703275cbe532da23e521e680ac4c66404cd1","observation_id":"391e333c-8e2b-4ff7-b82d-25b5272db031","resolution":{"observed_at":"2026-05-18T06:30:59.642197Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3ec0803e-f383-4010-998f-361dfb4f4916","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:d5f735e93824d23e9d68eac78309f01816a4b24803f474cbd0879ded9ea11c8c","observation_id":"c161efa0-3dbf-4f6d-b865-d83a9c7a8063","resolution":{"observed_at":"2026-05-18T06:30:59.842021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10080","last_updated":"2023-10-16T05:21:50Z","snapshot_observed_at":"2026-07-31T13:07:40.008796Z","submitted_at":"2023-10-16T05:21:50Z","title":"Let's reward step by step: Step-Level reward model as the Navigators for Reasoning","version":1},"cited_work":{"arxiv_id":"2310.10080","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.10080","snapshot_observed_at":"2026-07-08T22:35:40.657172Z","title":"Let’s reward step by step: Step-level reward model as the navigators for reasoning.arXiv preprint arXiv:2310.10080","venue":"cs.CL","work_id":"2e0e6421-b070-409b-b4d1-abd5f1d4837b","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2310.10080","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:a717baee8c7797f701f0643efcb2d0770216db0222387766a035d51bb180550a","observation_id":"4b31592e-ed42-4353-92aa-d078b568d8e0","resolution":{"observed_at":"2026-05-18T06:30:59.654041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01290","last_updated":"2025-01-02T15:10:52Z","snapshot_observed_at":"2026-08-06T20:27:37.215791Z","submitted_at":"2025-01-02T15:10:52Z","title":"ToolComp: A Multi-Tool Reasoning & Process Supervision Benchmark","version":1},"cited_work":{"arxiv_id":"2501.01290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01290","snapshot_observed_at":"2026-07-02T03:56:34.703401Z","title":"ToolComp: A multi-tool reasoning & process supervision benchmark.arXiv preprint arXiv:2501.01290,","venue":null,"work_id":"f81860dc-b357-457f-9128-6148e296df5d","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2501.01290","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:fc767ba793da1abc18b3fc690538a80d76e3690bbfba6a865a5c02e0f58ae32d","observation_id":"08612482-1849-40bc-b4a5-865a2c89e3a4","resolution":{"observed_at":"2026-05-18T06:30:59.663697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T11:26:12.372824Z","title":null,"venue":null,"work_id":"b2b8e4c9-2223-47d1-b0bb-83573eb2e28b","year":2022},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:fdf2d940168a70534baf5f26e260ee4e35d89a240a605ac6b2aa2f61e98dc9f6","observation_id":"63423bf2-a3ea-4f90-b5f3-d4136c2cb86c","resolution":{"observed_at":"2026-05-18T06:30:59.848426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05111","last_updated":"2025-07-15T21:10:27Z","snapshot_observed_at":"2026-08-04T06:14:02.568042Z","submitted_at":"2025-02-07T17:35:17Z","title":"Flexible and Efficient Grammar-Constrained Decoding","version":2},"cited_work":{"arxiv_id":"2502.05111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05111","snapshot_observed_at":"2026-07-01T23:26:22.261385Z","title":"Flexible and efficient grammar-constrained decoding","venue":null,"work_id":"77002bbb-fb88-4df7-824c-9211395c9877","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2502.05111","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:533c565a0510b4f67ee6868bff56edbfa0de107005b818f0088c796b43641984","observation_id":"620a79d0-3782-4070-8660-1611bd50fb8f","resolution":{"observed_at":"2026-05-18T06:30:59.630686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6d9b9583-46c0-4ee0-97b4-51d90021c0ca","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:fbbc55fb73adc1561b4992eb61bc24bac228d73f359849adecae6a26d57a16a1","observation_id":"007a2238-2634-42d4-8821-23f3c6bc0ad1","resolution":{"observed_at":"2026-05-18T06:30:59.805455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1247a302-fb73-469d-b971-d109420ceab4","year":null},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:ed7b0ebb14cbc621b63214a600ac1ea89844928530b0a2f75aab576016dc5ee3","observation_id":"2926cef6-95af-4841-b616-4cd3e6bc3119","resolution":{"observed_at":"2026-05-18T06:30:59.811888Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01618","last_updated":"2025-08-14T07:21:40Z","snapshot_observed_at":"2026-08-05T12:11:49.845245Z","submitted_at":"2025-02-03T18:50:50Z","title":"Rollout Roulette: A Probabilistic Inference Approach to Inference-Time Scaling of LLMs using Particle-Based Monte Carlo Methods","version":5},"cited_work":{"arxiv_id":"2502.01618","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01618","snapshot_observed_at":"2026-07-03T08:07:45.281283Z","title":"A probabilistic inference approach to inference-time scaling of llms using particle-based monte carlo methods","venue":null,"work_id":"6d2b732c-6772-403a-b73b-538c2e050588","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2502.01618","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:77cdb6e615baeec5073061ee9d8f31d57bb6741ac7162cd4ff9ad0bb7ca08d31","observation_id":"1717e218-1d08-4c5f-84ab-a7999bc19126","resolution":{"observed_at":"2026-05-18T06:30:59.602288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":"2307.16789","doi":"10.48550/arxiv.2307.16789","metadata_source":"pith","pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","venue":"cs.AI","work_id":"3c555b48-a4d9-42dd-9fdd-0f6018fbe9cb","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:418d6160b161596bf6739dd90497243bf28aa102e55d28b4ae63681dc02e36a2","observation_id":"32aa224f-b59e-4a2c-b0e1-7ee1a214fef1","resolution":{"observed_at":"2026-05-18T06:30:59.578892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:33.730697+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:33.730697+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-02T06:08:09.777151Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":"2410.08146","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-07-04T13:59:51.893694Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","venue":"cs.LG","work_id":"441f2f86-f865-4551-88a5-52267f220c59","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:5f9cdcdc59b84a329b41c26e84310368f34015620d6f65056f285029aa88af11","observation_id":"6828cce6-3059-4fce-a654-a571cab51ca6","resolution":{"observed_at":"2026-05-21T01:42:19.263401Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21295","last_updated":"2025-03-27T09:23:08Z","snapshot_observed_at":"2026-08-05T02:17:27.976287Z","submitted_at":"2025-03-27T09:23:08Z","title":"R-PRM: Reasoning-Driven Process Reward Modeling","version":1},"cited_work":{"arxiv_id":"2503.21295","doi":"10.48550/arxiv.2503.21295","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21295","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R-prm: Reasoning-driven pro- cess reward modeling.arXiv preprint arXiv:2503.21295","venue":"ArXiv.org","work_id":"46479788-3f50-424f-aa2f-04533830e1ba","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2503.21295","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:b4a3394227747d228ce7682b37e77acc169c8fb46d096f9aa73317edb208e9c4","observation_id":"a393c6a9-5bd3-4a51-8cf1-56aecfb7a3fa","resolution":{"observed_at":"2026-05-18T06:30:59.606855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bd67775f-779c-440d-8be3-a9ac89dfc798","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:9c7f9fb188d4b94d29f20a15ffc90706a6dcf3d24049d373bb2486d3cdc1faf1","observation_id":"925854b3-e40e-4209-9a5e-d11a70641fd3","resolution":{"observed_at":"2026-05-18T06:30:59.850924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:42fb8d2b7c2ab0b4107eddb1f206c945ad8b7ea5c8ead0e2d8faadf23c0b9b87","observation_id":"8248dd94-c26d-4fde-b360-5a13ed40df26","resolution":{"observed_at":"2026-05-18T06:30:59.660715Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b0d15c36-6bef-4510-823c-b4a457bb9c38","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:ccfd957d00a5f36c20d165e9f01b129a5caa798fd702e15365d1fc4c694ff4c1","observation_id":"be228116-fbcb-48cd-8b02-028d8b42b51f","resolution":{"observed_at":"2026-05-18T06:30:59.832219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05301","last_updated":"2023-09-07T12:20:45Z","snapshot_observed_at":"2026-07-06T15:40:20.267344Z","submitted_at":"2023-06-08T15:46:32Z","title":"ToolAlpaca: Generalized Tool Learning for Language Models with 3000 Simulated Cases","version":2},"cited_work":{"arxiv_id":"2306.05301","doi":"10.48550/arxiv.2306.05301","metadata_source":"pith","pith_arxiv_id":"2306.05301","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ToolAlpaca: Generalized Tool Learning for Language Models with 3000 Simulated Cases","venue":"cs.CL","work_id":"e900f660-9178-4fda-ad54-a788e23aa0d8","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2306.05301","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:d58e56158ab01b56a38a63a83fee60df78b106587f43bd65f324b632e04b1e01","observation_id":"f55998e7-1ea7-4cc5-b0b0-4f750348d20b","resolution":{"observed_at":"2026-05-18T06:30:59.519086Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":"2211.14275","doi":"10.2196/53233","metadata_source":"pith","pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Solving math word problems with process- and outcome-based feedback","venue":"cs.LG","work_id":"94492239-b1d5-435e-bea5-7f51992d0614","year":2022},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:dece86f415f43d01339834cc5a43c94462369979200704d08728fe32301472d0","observation_id":"97e00da8-0a75-4e4e-a0cf-0de3749a9b8e","resolution":{"observed_at":"2026-05-18T06:30:59.645851Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T12:02:29.539157Z","title":null,"venue":null,"work_id":"7baa2f31-aa95-40b7-b5f8-dc6bda5bc3be","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:8e775444e77141c6b05d4989ec801cf6514af7f16f286140fce6b8770c97be7b","observation_id":"03a9c651-3f17-4b7c-9447-57bbbf4ceb69","resolution":{"observed_at":"2026-05-18T06:30:59.839063Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:33ce7c83522c868d11836b36cf029df35577776d7d5d1f94ff10c745d9ee9c8f","observation_id":"068626db-bcde-44c6-97d5-60bc8ec2d10c","resolution":{"observed_at":"2026-05-18T06:30:59.588323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13945","last_updated":"2024-07-18T23:44:02Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:44:02Z","title":"FANTAstic SEquences and Where to Find Them: Faithful and Efficient API Call Generation through State-tracked Constrained Decoding and Reranking","version":1},"cited_work":{"arxiv_id":"2407.13945","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13945","snapshot_observed_at":"2026-07-04T08:09:40.741282Z","title":null,"venue":null,"work_id":"6e1bd9d9-7b76-4d72-9d58-c0183523b82e","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2407.13945","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:dde1dbc62426559583647c3ac9f6d0441112bd178ec9e4f5c4b95509d919c68e","observation_id":"a4b6b840-84ab-4cd2-bd0d-0c16da71d5ca","resolution":{"observed_at":"2026-05-18T06:30:59.559773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T12:02:29.513226Z","title":null,"venue":null,"work_id":"dea70e32-4554-4ae1-a7b9-e3bf50a7c5cf","year":2022},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:7da800520817d8df2f2e1de8080f6a6b0d0195156ff17dfea2a298bc7e70b2ac","observation_id":"b5e02fd0-1669-4488-8df7-af8a33674b90","resolution":{"observed_at":"2026-05-18T06:30:59.821827Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":"2408.00724","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-07-04T11:09:46.442555Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","venue":"cs.AI","work_id":"cef2c407-5d51-46a9-8eb6-f382b419502e","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:f09eabbd859742b2589b37dc4037d3794719632ca7c41b5b9a5acedc817e361a","observation_id":"96f9edef-599d-4bfd-8bfa-511020ba72d8","resolution":{"observed_at":"2026-05-18T06:38:37.536547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05668","last_updated":"2025-08-19T05:15:19Z","snapshot_observed_at":"2026-08-06T05:30:35.068556Z","submitted_at":"2025-08-03T08:02:51Z","title":"A Survey of LLM-based Deep Search Agents: Paradigm, Optimization, Evaluation, and Challenges","version":3},"cited_work":{"arxiv_id":"2508.05668","doi":"10.48550/arxiv.2508.05668","metadata_source":"pith","pith_arxiv_id":"2508.05668","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2508.05668 , year=","venue":"cs.IR","work_id":"d504829e-614b-4812-bb38-8ee43f2a863f","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2508.05668","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:6d38cace7ff3f8441003e19e12a3485b4e3289f39110fbb21239573b49f7b346","observation_id":"43344374-0792-4759-a849-971fb36ac07d","resolution":{"observed_at":"2026-05-18T06:30:59.569559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cbb034dc-412f-4b1a-9b79-8f56382fdaf8","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:17bb31bed49cf8d90ce00789a7ecbdd2f7cd231c5880f049fe1ae83dddb7d8b8","observation_id":"918cd683-66a0-4376-9856-346f2e6d423d","resolution":{"observed_at":"2026-05-18T06:30:59.844925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2cff5782-5c24-4fed-85d9-2c2bb9d1174d","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:b139566b8fb083de592eae8e1bfb03fa1a8a746e99eaac9ce125197b7bdbd6f8","observation_id":"32a737ee-c8eb-440e-866b-45c37f0b72c0","resolution":{"observed_at":"2026-05-18T06:30:59.799194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":"30d5a754-7c3b-449f-92c8-88cb1ffd2f8b","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:a54c59e64a86cd60e270ccc576764cb292ea50ee2ed93e9f1c4ea041ebeb39da","observation_id":"c7bfe2cd-cf5c-4305-9408-18ed1391269f","resolution":{"observed_at":"2026-05-18T06:30:59.825313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:22d108b6186dad50d028bf58fc76fd6200bf430787dba4dd038eb159a04be27f","observation_id":"c192e203-5400-42fa-8e3d-17a81028c125","resolution":{"observed_at":"2026-05-18T06:30:59.523905Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16736","last_updated":"2025-06-21T17:39:43Z","snapshot_observed_at":"2026-07-31T15:41:38.725206Z","submitted_at":"2025-04-23T14:07:26Z","title":"A Survey of AI Agent Protocols","version":3},"cited_work":{"arxiv_id":"2504.16736","doi":"10.48550/arxiv.2504.16736","metadata_source":"pith","pith_arxiv_id":"2504.16736","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of AI Agent Protocols","venue":"cs.AI","work_id":"7233e34f-dc80-449b-94df-ceb2ee783ea5","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2504.16736","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:9311e65d4db8c58561f908483e78838ba93b7d18e4a47e0e8193bc04eefa2256","observation_id":"9c67cde5-0d68-4acb-9277-7a45fbac2c86","resolution":{"observed_at":"2026-05-18T06:30:59.539545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T12:02:29.517225Z","title":null,"venue":null,"work_id":"245fb4ba-1249-45c7-8842-196e254cf89c","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:f163efcb2aae7a8bb9cfef51cd576a5a4106d6d8fbf8b45a93f1652ef2551d28","observation_id":"3aacf2e3-0c34-4f36-8298-c6fc18618c3a","resolution":{"observed_at":"2026-05-18T06:30:59.835569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05510","last_updated":"2023-03-09T18:59:47Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:59:47Z","title":"Planning with Large Language Models for Code Generation","version":1},"cited_work":{"arxiv_id":"2303.05510","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.05510","snapshot_observed_at":"2026-07-02T15:27:06.057125Z","title":"arXiv preprint arXiv:2303.05510 , year=","venue":null,"work_id":"57fbbeda-95db-4e3d-aeaa-542766e51730","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2303.05510","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:1a7e14b0f995583a5eb27ff0e6badcdb24d0a56d06e4d4554f8c84f9064c499e","observation_id":"e001f309-f4d6-41ee-8021-b8e119e89a4b","resolution":{"observed_at":"2026-05-18T06:30:59.583413Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09713","last_updated":"2025-02-23T03:23:46Z","snapshot_observed_at":"2026-08-05T07:48:17.311058Z","submitted_at":"2024-10-13T03:45:24Z","title":"Agentic Information Retrieval","version":4},"cited_work":{"arxiv_id":"2410.09713","doi":"10.48550/arxiv.2410.09713","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.09713","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zhang, J","venue":"arXiv (Cornell University)","work_id":"c8ef0e25-e5ae-477d-b29e-df4f6367070e","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2410.09713","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:82677333d3fe27376280f1c9d87069eb8dad8982f336275355ce6be78ca0a1c6","observation_id":"1a46003b-6abc-497c-bb21-b1a18866556b","resolution":{"observed_at":"2026-05-18T06:30:59.597734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a7b66fd8-5286-4ff7-ad57-d8c266f90ee4","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:6007eaa22f40c2b80e07678b2abd107e7da03034f76646c4729f5dd71a90b096","observation_id":"a74af252-5087-4d97-bf99-1089b48f85dd","resolution":{"observed_at":"2026-05-18T06:30:59.795619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15698","last_updated":"2026-05-19T07:11:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-21T15:07:59Z","title":"CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":"2507.15698","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15698","snapshot_observed_at":"2026-06-30T11:54:38.713100Z","title":"Cold: Counterfactually-guided length debiasing for process reward models","venue":"cs.CL","work_id":"21fecb2e-5e3a-4629-8b21-dc8b5ff7012e","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2507.15698","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:386ac76dd7bec6f0ca57a324930dca215fd2f9407dc92c24a12282fe6c8aea24","observation_id":"a3e94bf0-9133-432f-add4-393ededb352e","resolution":{"observed_at":"2026-05-20T02:04:43.676793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08049","last_updated":"2026-04-29T02:51:24Z","snapshot_observed_at":"2026-07-06T22:32:07.945004Z","submitted_at":"2025-10-09T10:35:31Z","title":"A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models","version":3},"cited_work":{"arxiv_id":"2510.08049","doi":"10.48550/arxiv.2510.08049","metadata_source":"pith","pith_arxiv_id":"2510.08049","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models","venue":"cs.CL","work_id":"1b364adb-2d12-4e61-89fc-804d607b2735","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2510.08049","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:9768569294fdf7ceea71716dd32a688d33b257133ef23fed2368d3223518b1f8","observation_id":"2d850bde-0282-4b18-a290-f3dc3a01aeff","resolution":{"observed_at":"2026-05-18T06:30:59.555716Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10132","last_updated":"2025-01-17T11:41:53Z","snapshot_observed_at":"2026-07-06T20:22:23.609336Z","submitted_at":"2025-01-17T11:41:53Z","title":"ComplexFuncBench: Exploring Multi-Step and Constrained Function Calling under Long-Context Scenario","version":1},"cited_work":{"arxiv_id":"2501.10132","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10132","snapshot_observed_at":"2026-06-29T13:13:27.295521Z","title":"ComplexFuncBench: Exploring multi-step and constrained function calling under long-context scenario","venue":null,"work_id":"032fd075-966f-46cd-b9f4-8b03ac993484","year":2025},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2501.10132","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:c4dfb79fdb6870e364106959362558876cefd4d69604b29154d5e1a12ad1db87","observation_id":"4375bd75-ef7d-4680-859a-649132589594","resolution":{"observed_at":"2026-05-18T06:30:59.667113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04406","last_updated":"2024-06-06T02:51:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:55:11Z","title":"Language Agent Tree Search Unifies Reasoning Acting and Planning in Language Models","version":3},"cited_work":{"arxiv_id":"2310.04406","doi":"10.48550/arxiv.2310.04406","metadata_source":"pith","pith_arxiv_id":"2310.04406","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Agent Tree Search Unifies Reasoning Acting and Planning in Language Models","venue":"cs.AI","work_id":"810dbb8b-e954-4797-bf0d-5d8cad94e524","year":2023},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2310.04406","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:3b7660564604d0c2b07c58bb90f22dc4e953b85d663c4b3d94ccc58d669f6abb","observation_id":"251c1f51-7dfa-47e9-9dd1-cf90f0b7df5d","resolution":{"observed_at":"2026-05-18T06:30:59.550154Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":37,"verified_fuzzy":2},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 2 inbound Pith citation observations for arXiv:2510.14703."}