{"as_of":"2026-08-05T14:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a3020c3340b3ca8fd00db7c8318545fc26e8bfdb1d8c6688cd67fb3fe3344bbf","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T22:54:44.329613Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T15:12:55.711751Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07074","snapshot_observed_at":"2026-08-04T15:12:55.711751Z","title":"2026 , archivePrefix =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02097","last_updated":"2026-08-03T11:58:21Z","snapshot_observed_at":"2026-08-05T13:42:50.796875Z","submitted_at":"2026-08-03T11:58:21Z","title":"Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-04T15:12:55.711751Z"},"links":{"cited_paper":"/paper/2606.07074","citing_paper":"/paper/2608.02097"},"observation_digest":"sha256:ec0d542054ddca30a4c9aa2e2931db804da16c3b588c25c21976a7ad08fa28b0","observation_id":"3805ba68-97ae-4d51-b76c-faf84d01ee4d","resolution":{"observed_at":"2026-08-04T15:12:55.711751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.07074/citation-record","integrity":"/paper/2606.07074/integrity","json":"/paper/2606.07074/citation-record.json","paper":"/paper/2606.07074"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.04618","last_updated":"2026-03-29T09:18:02Z","snapshot_observed_at":"2026-07-06T22:31:49.574184Z","submitted_at":"2025-10-06T09:30:18Z","title":"Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models","version":3},"cited_work":{"arxiv_id":"2510.04618","doi":"10.48550/arxiv.2510.04618","metadata_source":"pith","pith_arxiv_id":"2510.04618","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models","venue":"cs.LG","work_id":"c1d09cf9-9176-403d-8028-630bbc0cbc5d","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2510.04618","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:88ffa765440896256aca643ec7d24e5282c40a581625ad11bd576405ec3808a5","observation_id":"5bf74fe5-ff73-4ba7-83cf-5024ecf73bde","resolution":{"observed_at":"2026-07-02T16:17:08.719104Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:03.57435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:03.57435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"arXiv preprint , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:6fdfe6c76b18fb0c86750382b087f7460ce7fd2ba7195e52aead28daab5aa15b","observation_id":"25f6b5d4-eefd-4e80-9596-a3a687676641","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.14234","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T20:05:34.003466Z","title":"Redsearcher: A scalable and cost-efficient framework for long-horizon search agents","venue":null,"work_id":"fbfb7693-53da-4498-8b80-3e1c3d3dd9b1","year":2026},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:3fcb9dfa2379d1d2e2e47408a9a007827dd8ad0d06dd9c957e14e685bfbff240","observation_id":"39a04c05-c820-4433-bb16-47b878c1c6f1","resolution":{"observed_at":"2026-07-02T16:17:08.707682Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:0990a00da929becea809b2a6d2944a187a58ea6ae6d7dc12c69f5fed3bbeff8d","observation_id":"d5ea0b72-4abb-43b0-9dd7-e93dc0b58ffa","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Trends in cognitive sciences , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:a2569da2a7f5ca6708a9d9cf550828c24af51086b7bd0fec06db08199f9405f3","observation_id":"5d082420-9ea2-4782-8e1a-9b93197b14d5","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-07-06T21:01:00.397040Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":"2503.23383","doi":"10.48550/arxiv.2503.23383","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2503.23383 , year=","venue":"ArXiv.org","work_id":"aec6658a-b95b-4edc-942e-10f5203b0b6b","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:77c02aa76f570f9eb0fd1266a3256a2be11fbb0bc880b5234af22d9a73cd2a4a","observation_id":"3385bd01-37da-4c78-8fe7-45aac4978f0c","resolution":{"observed_at":"2026-07-02T16:17:08.740016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:5284ef877e7cab300a4041f09f9cbb9626ddbaa8f885adfddb4a94cf73b2f740","observation_id":"4c9f3de3-143b-4979-9637-887c9ed95e1c","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:acf076dff0d9fc3f3f7962f5d0a2818afd64bbc72aa7f96643cb7b70699956af","observation_id":"cc8eaec8-3ae0-4b44-8108-681acb3bbfce","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10055","last_updated":"2025-06-17T15:19:26Z","snapshot_observed_at":"2026-07-06T21:40:36.021335Z","submitted_at":"2025-06-11T17:58:14Z","title":"TaskCraft: Automated Generation of Agentic Tasks","version":2},"cited_work":{"arxiv_id":"2506.10055","doi":"10.48550/arxiv.2506.10055","metadata_source":"pith","pith_arxiv_id":"2506.10055","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Taskcraft: Automated generation of agentic tasks","venue":"cs.CL","work_id":"f50e1a78-f462-4e9c-8b0b-724212df1fad","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2506.10055","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:a58474c2191e8dd8a023e4e08c63a90bd631f5bf565577d9ec2f371daa28c5ed","observation_id":"ab72918b-1abd-4887-a64c-47f42760e870","resolution":{"observed_at":"2026-07-02T16:17:08.737126Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.07976","doi":"10.48550/arxiv.2508.07976","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Beyond ten turns: Unlocking long-horizon agentic search with large-scale asynchronous rl","venue":"ArXiv.org","work_id":"cf9b5d87-269e-421e-aec4-52f7899c89f0","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:d8b90ce2a75bbe36253448417a6de89cbf9e9be8760dd0651801a5d2a337a729","observation_id":"01ba6e2f-8fe1-4855-aab0-0060589cd9f4","resolution":{"observed_at":"2026-07-02T16:17:08.732382Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16812","last_updated":"2025-08-27T03:10:49Z","snapshot_observed_at":"2026-07-06T22:01:12.359748Z","submitted_at":"2025-07-22T17:59:03Z","title":"MegaScience: Pushing the Frontiers of Post-Training Datasets for Science Reasoning","version":2},"cited_work":{"arxiv_id":"2507.16812","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.16812","snapshot_observed_at":"2026-07-05T15:11:10.807862Z","title":"Megascience: Pushing the frontiers of post-training datasetsforsciencereasoning.arXivpreprint","venue":"cs.CL","work_id":"d21e62b1-0689-4840-b3b4-eea8eb829a15","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2507.16812","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:4d2f5df15ff00c178c105a886f2bbd2d28b4b087b52d606a74af74a46f5da24e","observation_id":"ee7f0890-d191-4cfe-b732-a9355bba65bb","resolution":{"observed_at":"2026-07-02T16:17:08.710767Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22648","last_updated":"2025-08-10T06:05:46Z","snapshot_observed_at":"2026-08-03T10:37:02.820839Z","submitted_at":"2025-05-28T17:57:07Z","title":"WebDancer: Towards Autonomous Information Seeking Agency","version":3},"cited_work":{"arxiv_id":"2505.22648","doi":"10.48550/arxiv.2505.22648","metadata_source":"pith","pith_arxiv_id":"2505.22648","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Webdancer: Towards autonomousinformationseekingagency.arXivpreprint","venue":"cs.CL","work_id":"ca106a7e-910e-4725-b167-348c28d18f1c","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2505.22648","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:ba46853058ddb8354381c57b7cae0ae3de2c18ccd4abbf17419591a8e0bde577","observation_id":"7b02dcca-b0a2-4f0a-8ed2-012566e937b5","resolution":{"observed_at":"2026-07-02T16:17:08.729780Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-025-09422-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T03:06:43.562716Z","title":"doi: 10.1038/s41586-025-09422-z","venue":"Nature","work_id":"9835b482-5032-4135-93dd-82a066677569","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:e53d8a12bf3894b7df10ad6555246685a3cc7f05d989e3642060870a769baf1d","observation_id":"ee6a4d13-c4fd-4b38-a583-a5936563d055","resolution":{"observed_at":"2026-06-27T23:01:22.107218Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:21.094896+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:21.094896+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:eef71739814642c2c272ef7a808168de699bef047668807456fb565dcac15693","observation_id":"4925feed-e602-4644-83d2-3201ffcfa204","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:b65d7c6b5f34fa9c4225bdd5c8abcb50b5bb06ea7fbfadf86c80b12675d536fc","observation_id":"cd9bec42-f6ed-4cfc-9988-1e819b5c3672","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:8dd16b1120d6361f436fb1629e4df44291165e6bb362be69a96baf93c552df09","observation_id":"d2c7cd9c-ca6b-4380-b57f-4aed753d4bfa","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:7f1e5cae5a4b187e4b1be9b87c472c89940103aaccd31d68b5b91df7e67f2b17","observation_id":"c978315a-4a13-4f73-ac16-bbb72ec13873","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:ce57363bec4ad8817b1fec32f4fc4ac2b7e10eae5804960aeedaaab45d95aa7d","observation_id":"17732dca-ab76-4268-a0e2-799b141b185f","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:2bfa6fbed9234a8a032dbb3f51262ec75b587c1354c56764ab7d589292f8ebd5","observation_id":"bae48c2a-7100-4262-9a63-161b23b38da6","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:3a35851e19e4ac85921613064ca7c105b363f60266cbaede8c17556df705e167","observation_id":"9197fffb-6870-481b-978e-0b02f7521110","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:21bd5d84305fb60f4f5a18667cd741412cbba82d8e056162d7345911a72da873","observation_id":"19e1f1eb-2c4b-417f-9a41-4dbfd584d166","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:b698b310baa01345d0d9b01124ff367ea9aeed58da76de69284fcca17942ccf0","observation_id":"caac57bd-237e-4d05-8fc8-7b0ac975a9d3","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:2d50743ff925645f914d45a70223689c8b800deab2cbe3025da0bd2de3ff190d","observation_id":"cbfd8b78-3e45-449a-b8b2-29b7faebdb4d","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:adbaf21bfadffe7ec2151950aa19445e662274019c66fae78cff21ac86ddd187","observation_id":"0d43f80e-5b5a-407c-803c-e9cbbef7b2d0","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:d743e81e37e920a3e32c0433c5a63dd4373e925f0e22fe4d6e4e98b4aed6d2ab","observation_id":"93ff7c24-9b8a-4fbf-b6cb-08bb9b7779c9","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:083bf8ec87e6b56c540af3e14eb2810ded3fb91f12adfc35d15aa1e3b7b8e951","observation_id":"1fbba788-1193-4e2b-82e7-36485fc5cc40","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:5b15866cb0783df050c1f7ce0136ae07476f0ead88a50dcae209b4a5a8c8196f","observation_id":"110055a7-bda9-489b-94af-99ff72a2b1f0","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:04846fdb11c0c66b748132c9fb7f764d4ef10f1131ef1f21e4394e5bcb89b1ec","observation_id":"18fefb7f-93e4-4f8c-b90f-f45244dcac87","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:e4e89689affe517a55bc6cfbb7065751830e5ed9473d879e1e3107de348134f5","observation_id":"4683d56d-900d-4032-9ace-2cdaf5bb3c72","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:f2796497ebdd620acab65a5ac7d2b3f0379687540e6573195d127d701daf0e41","observation_id":"444ccf6c-c402-4abd-804b-4985c5ea6eb3","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:b3870576f4419fe438fbbcadb8e02a081fc2684fc20285107b3eac6c89ee64d9","observation_id":"bddaa661-b05d-4922-9040-d4efc50637f7","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:17cf9e2ff814a7b26b13c54fee8866120779df0e11d901b8bf70bbe2c4052381","observation_id":"c56ef6a5-1e04-42da-b493-e497cbde8fc8","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:b517e705ec043c99302eed70c6b476f91347b99a6eebb0529855cad79a245946","observation_id":"faca24fc-9b20-4714-a9f8-0dc51a85b95e","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.459","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Zhang, Wen and Chen, Huajun","venue":null,"work_id":"394eb9ab-3b98-4496-ad56-10571f932921","year":2024},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:c97426d121e578d98f582d11b3f4f70e3f7710045d849583e155bcbe14a623bc","observation_id":"1ade667e-2d65-4bf0-b6d4-400f8762b65c","resolution":{"observed_at":"2026-06-27T23:01:22.110079Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:aebf9b5f3f2597c5483af8fc39e705cce568c503e125d4082938d13354b3a46b","observation_id":"a7e05b02-3576-4203-a281-de450fad5b1c","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:078bc7ba741dad580350d7fe5e96e646500d922d7e9f847cddc06bc2f2180f9c","observation_id":"9222df81-e6b8-4665-9328-3c67cc35938b","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.1274","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token-budget-aware LLM reasoning","venue":null,"work_id":"aced01a2-ea77-4f44-bc94-469663483aec","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:24531d78a279b4ff51456e7cdecc97685055d636ae7b484bc93c7aac070eec70","observation_id":"ad29ad89-8557-4c0b-b973-047e8efdba5a","resolution":{"observed_at":"2026-06-27T23:01:22.111248Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:43144ae720a57fca98317e4fdcc4e237f1b0edbf602c8069cf7fe5b1d79cc98c","observation_id":"92049b63-ad95-4395-a491-30a6baffac18","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.1125","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brevity is the soul of sustainability: Characterizing LLM response lengths","venue":null,"work_id":"95918458-5d9d-4533-a41e-d157b123c757","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:86161b87a3cf9a1271bfa4095a44f74ea16b1ea2c653c2ad6dd99b242d54a682","observation_id":"91dc4761-d59f-445a-9aea-a88a31ac75ff","resolution":{"observed_at":"2026-06-27T23:01:22.113281Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.300","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoT-valve: Length-compressible chain-of-thought tuning","venue":null,"work_id":"7a5b7e69-8ba6-4a06-8ff3-711373a66509","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:ad70c1536dfd63a429c6a500c184650406d9958d3a9c54db6036ca40cf4fa6ec","observation_id":"df106c8f-2f29-4dd8-abda-f3fd7e40e2c5","resolution":{"observed_at":"2026-06-27T23:01:22.115514Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T05:52:58.659016+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T05:52:58.659016+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.1289","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Training Elicits Concise Reasoning in Large Language Models","venue":null,"work_id":"cb8fbdb4-8a53-4284-84cf-a00fac547d9e","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:924499bc80098fbae30e3422a6f234354063244137d993cd721011e075d7fb49","observation_id":"03a4eaf5-a9f0-4683-90cd-082263815835","resolution":{"observed_at":"2026-06-27T23:01:22.099913Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.956","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models","venue":null,"work_id":"c638f02b-72fc-4e5b-94b6-4a43f5abe3e3","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:3b5b2cd3557f1299dff1cf126f7a3647bbc69d9eef8b6691b7042cfca0a737ee","observation_id":"bfee271f-7c57-49a5-be48-63e0c87d9901","resolution":{"observed_at":"2026-06-27T23:01:22.106291Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:0de3d37e5fe87f748cc18632fb5bcc1daa9eb517fbffd14dc8fa645b07ade334","observation_id":"06f395d6-d57a-4e57-8819-791e80f6d5a2","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:5bd56eccd486fb44fee983902311e0dbffbfd20ddf4ef2208cced6dfcd4ea329","observation_id":"50f8c244-2307-498b-af7c-c1cdf8d833f7","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.927","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"C oncise RL : Conciseness-Guided Reinforcement Learning for Efficient Reasoning Models","venue":null,"work_id":"630677db-76fe-40fc-954b-8c2b41d5114b","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:8254501f71aa9d04e48056ce5c597f4592cbe1308191b626ea82c2aa42060507","observation_id":"9e21b46a-7ca2-4a3c-b52f-a8158b4641a2","resolution":{"observed_at":"2026-06-27T23:01:22.104385Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2023 , html =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:7d59151ac9b45a652eb54347803116b77f1dd205c250303bc5c54f99129a2323","observation_id":"6f292445-963f-4ea4-a6d1-4e6a4788ec8c","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-03T00:43:33.338074Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":"2504.12516","doi":"10.48550/arxiv.2504.12516","metadata_source":"pith","pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","venue":"cs.CL","work_id":"25adb508-d97c-49d6-ae43-7a70c2478a34","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:f43f64995919049a91d16ecbb690dfdb81c630697f7e83e7b7fbf7d27fcaa647","observation_id":"4cfaf380-a995-4355-8adc-d282437a9339","resolution":{"observed_at":"2026-07-02T16:17:08.729283Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":"2501.14249","doi":"10.1038/s41586-025-09962-4","metadata_source":"pith","pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Humanity's Last Exam","venue":"cs.LG","work_id":"59ea00d4-16a8-45e1-aafc-290a6f91d9f4","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:b4d92d7209c17f26f969fabb15d6c70dbe469e28da008e81a30508e5ea251c1a","observation_id":"22127b60-022b-4647-b48a-31b2af738b4c","resolution":{"observed_at":"2026-07-02T16:17:08.720372Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:9fe334e5bd8e885457dc3831da65568d9af3a9e59c9896d9f91053833faed421","observation_id":"2e5d84c7-279a-4af1-8787-312be4ec6f9b","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:ec6e6b73b1f0c1d83b507abcc0ab161c2a8176da1d8e9d986ee2aad2cf531a14","observation_id":"50a6a5c3-55a2-4ff3-bcf3-dafcede02eeb","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:16a91dac8b69d190bbc5929d096a9d0a2e1b2c6ef2c674660b4d4816e2b726a3","observation_id":"d596a6b3-79d0-49d8-8192-96db61fbc598","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:67b7fa122b2fc0573585e6cb15c835fdad74135d73bdcca52754885fa6fc5e25","observation_id":"830c66a3-ac68-4436-a60c-480f8380f8d8","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:befae5d10c8bbf1078c052569588a1ad25c9eac4c0c241f327f1336f87c46046","observation_id":"7370c642-03b3-41dc-87c1-0bcc9a13f1cb","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:99ce007c1b163a59b2e357a4debbc802533e07d3848609bee6c7fca4cd48ed25","observation_id":"21776ca8-b2b8-4b4d-8120-7898394546c2","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:c00878201c5c16d32d23f11e1179dfccac82a2a96093379c5d2a2bbe460b6838","observation_id":"c2815098-0af8-4e58-9ac4-4a105db396ef","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Machine learning , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:1cb65775cc2fc80a6f8ed8ca353c2739d043d117fc03c4e197a1aadab5ca7b00","observation_id":"cf913ed3-f3f2-41b6-bdb6-6792f99dce26","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18939","last_updated":"2026-07-14T02:30:28Z","snapshot_observed_at":"2026-08-04T08:48:33.653619Z","submitted_at":"2025-10-21T17:58:45Z","title":"Lost in the Maze: Overcoming Context Limitations in Long-Horizon Agentic Search","version":2},"cited_work":{"arxiv_id":"2510.18939","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.18939","snapshot_observed_at":"2026-07-15T01:20:48.939128Z","title":"Lost in the maze: Overcoming context limitations in long-horizon agentic search","venue":null,"work_id":"ee044fa4-5025-4cf8-bd1d-24d7b2958c42","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2510.18939","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:0fc998e4b9284685d0c9354286f88a71090249c60a894b2cbe4faa3f168901e7","observation_id":"36bb1f0f-8cda-4c08-88af-df86b168a2a4","resolution":{"observed_at":"2026-07-15T01:20:48.939128Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:400690fde4acc5b190764a0b8f1c03601166861411a2e03b615d2d1de0fb04b3","observation_id":"4c09d938-fcb1-48b2-865a-423e2a18bd28","resolution":{"observed_at":"2026-07-02T16:17:08.710917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2503.09516","doi":"10.48550/arxiv.2503.09516","metadata_source":"pith","pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","venue":"cs.CL","work_id":"0e0b7549-2bc4-4574-aa7f-588ffa16eaae","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:5486af102e2358083e82ec791717e10e9291ecbcc7aef41e7fe9d9c7c4fba149","observation_id":"cd5e4a56-d062-4aeb-a46f-f54a7a37b38e","resolution":{"observed_at":"2026-07-02T16:17:08.724048Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:a35c0957787fa4b3ba6906a8a2ee9e673c2e9034f24b0df2451a6a4d401e6ddb","observation_id":"effe22ee-5d3d-430c-9d47-f4a2d8eac63e","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02592","last_updated":"2025-07-03T12:59:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-03T12:59:07Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","version":1},"cited_work":{"arxiv_id":"2507.02592","doi":"10.48550/arxiv.2507.02592","metadata_source":"pith","pith_arxiv_id":"2507.02592","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","venue":"cs.CL","work_id":"fec5a195-1dd5-425a-b552-109af948a7dd","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2507.02592","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:26c11863c6d9b64890a02fa0314eeb7db88f9bb19794a5e9aba100c506a51371","observation_id":"511843e7-68a0-41c7-9c62-111655cdc743","resolution":{"observed_at":"2026-07-02T16:17:08.731950Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:2c58f60b0cccae745aec0c437497a6f18634332bb8217fb14ed6376a7fdee364","observation_id":"3a18c2d4-a3c8-4494-9ab3-8735bfffab7a","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:0ade285ff204b04fa97cba475eadf4e36e000013381734df00a63f378e7fc8a2","observation_id":"2b60eba8-76ac-44e9-9eff-12c73a47bc3d","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-07-06T20:42:42.466871Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":"2502.18600","doi":"10.48550/arxiv.2502.18600","metadata_source":"pith","pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.18600 , year=","venue":"cs.CL","work_id":"9bb5ce25-93d1-4df0-bba6-491d6ba79d28","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:0a490e474f87a090b631c2b2907f73848a45d7e26605fe6d0fef7d4ed25c48d8","observation_id":"e2ddf3f0-2ca5-4636-8d72-ee5552eb22a6","resolution":{"observed_at":"2026-07-02T16:17:08.737281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:b9eff114b51220111452b7a0878de22cbc8ebe9e0cb3f8e0720f4ef7872939a6","observation_id":"df781a40-c390-436b-8bba-b8a4bce0fda1","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:66b27ca969044faaf6c3017d00f504230c4e7a40fa45498353e740969d02acf0","observation_id":"ba7afa63-9aa7-4075-bfa4-30461a37513b","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2503.04697","doi":"10.48550/arxiv.2503.04697","metadata_source":"pith","pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","venue":"cs.CL","work_id":"ad7236fb-3752-48a9-b782-a384899c45a0","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:be525cbe10fa636edc300c2a40889f1c5b8dee6a5dc088a01b19785ae1ec95e2","observation_id":"a9b2f759-910e-4fb0-a6a8-1ff9d0254e77","resolution":{"observed_at":"2026-07-02T16:17:08.734755Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21776","last_updated":"2025-10-13T12:40:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T16:25:25Z","title":"WebThinker: Empowering Large Reasoning Models with Deep Research Capability","version":2},"cited_work":{"arxiv_id":"2504.21776","doi":"10.48550/arxiv.2504.21776","metadata_source":"pith","pith_arxiv_id":"2504.21776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebThinker: Empowering Large Reasoning Models with Deep Research Capability","venue":"cs.CL","work_id":"7e319d34-eb88-4ea9-8c0d-b66320599f98","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2504.21776","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:2886e7a5a6651942c8995812e7d5865447dbab5dddf1d4842789a8c772ed98fa","observation_id":"2e2e3328-21a9-4567-ae07-33c59a1997db","resolution":{"observed_at":"2026-07-02T16:17:08.693024Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:3e63a0aaca3d9b345f079273e6ac89f35d2fc3bf684839a5b7432e1238993073","observation_id":"f95c3587-0887-4e58-949c-5bd042eb236f","resolution":{"observed_at":"2026-07-02T16:17:08.692863Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:f26cf811853b7c72986a3c8e32c20e4416d5efd9a375cb20730efef64ec67794","observation_id":"935b0911-fa4c-485b-b4e3-e3ab89f970a6","resolution":{"observed_at":"2026-07-02T16:17:08.690809Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Proceedings of the 29th symposium on operating systems principles , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:953e7b1b44791c4d6019c9c91c0339728777cfeae7153689fb36d6f2a856e051","observation_id":"aed3a9bf-ad39-4ad5-b8c4-046a3c8222bd","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"Proceedings of the Twentieth European Conference on Computer Systems , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:408cf6901a09e2ea32dff99a0a6344e5ccfb9ee79e2210a0682f3d8b8829f0e5","observation_id":"5c0c62e5-b9c5-492e-823f-4dc744ca747c","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:3cfdaccfab3d24013b5f6999aa9a85705ca103e3b172f48942b6dfaeff645a75","observation_id":"084385a6-5428-49e3-834c-6d009be86dbc","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T22:54:44.329613Z","title":"2025 , howpublished=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:e3c9383dd7639df500b1a6f17759c5ae3b79df7b7763943ae8b8f706c249971a","observation_id":"d97ab84d-5e59-4a72-b7bb-c38213e5a647","resolution":{"observed_at":"2026-06-27T22:54:44.329613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":14,"parse_uncertain":1,"unresolved":47,"verified_exact":12,"verified_fuzzy":0},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 1 inbound Pith citation observation for arXiv:2606.07074."}