{"as_of":"2026-08-08T18:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c364597a4936bbfef0739a54b54acba36e5aeb38999176cc1edbb57568c4cb95","coverage":[{"denominator":101,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:05:21.985940Z","state":"measured"},{"denominator":103,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":103,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:19:01.924228Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T11:19:04.829030Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"cited_work":{"arxiv_id":"2505.20128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20128","snapshot_observed_at":"2026-08-07T11:19:04.829030Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","venue":"cs.CL","work_id":"b96a3686-25e4-43e8-9c2c-cc4359e1c104","year":2025},"citing_paper":{"arxiv_id":"2506.02839","last_updated":"2025-06-03T13:08:17Z","snapshot_observed_at":"2026-08-08T11:41:37.910337Z","submitted_at":"2025-06-03T13:08:17Z","title":"DeepShop: A Benchmark for Deep Research Shopping Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:19:01.924228Z"},"links":{"cited_paper":"/paper/2505.20128","citing_paper":"/paper/2506.02839"},"observation_digest":"sha256:ae4a1d1f019f3fc22aaa3e2328b06121408c1ab43f8c033a589050fdbee5dbbd","observation_id":"707e4ca1-d924-408b-b4ce-ec74d739b446","resolution":{"observed_at":"2026-08-07T11:19:04.942153Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20128","snapshot_observed_at":"2026-08-04T06:57:15.870446Z","title":"Tong, Y .; et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.27568","last_updated":"2026-06-18T02:08:20Z","snapshot_observed_at":"2026-08-07T20:39:51.915446Z","submitted_at":"2025-10-31T15:51:00Z","title":"SIGMA: Search-Augmented On-Demand Knowledge Integration for Agentic Mathematical Reasoning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T06:57:15.870446Z"},"links":{"cited_paper":"/paper/2505.20128","citing_paper":"/paper/2510.27568"},"observation_digest":"sha256:e91cb57dc57b84723696746c3c66133e9df8f54d56d690f80097ae45715904ae","observation_id":"3d901d72-7360-4ee7-994c-5de564539b09","resolution":{"observed_at":"2026-08-04T06:57:15.870446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20128","snapshot_observed_at":"2026-08-04T15:12:55.883703Z","title":"2025 , archivePrefix =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02097","last_updated":"2026-08-03T11:58:21Z","snapshot_observed_at":"2026-08-07T22:15:33.180420Z","submitted_at":"2026-08-03T11:58:21Z","title":"Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents","version":1},"reference_index":141,"source":"arxiv_source","source_observed_at":"2026-08-04T15:12:55.883703Z"},"links":{"cited_paper":"/paper/2505.20128","citing_paper":"/paper/2608.02097"},"observation_digest":"sha256:1097a88b0045b054853082ee7a0d101d5e4867062a73eb0acbab37d50cdbdcfa","observation_id":"51c984df-a44d-4418-a62e-672d1cb39fa0","resolution":{"observed_at":"2026-08-04T15:12:55.883703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20128/citation-record","integrity":"/paper/2505.20128/integrity","json":"/paper/2505.20128/citation-record.json","paper":"/paper/2505.20128"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:13.505390Z","title":"Information retrieval on the web","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:13.505390Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:c10f7e6c959729945b48100b34cacd541482fde816762d49b6c11376f74f1abe","observation_id":"c95bbf79-e5a6-4b03-a6f7-26c69e8f71ac","resolution":{"observed_at":"2026-08-07T14:05:13.505390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:13.604740Z","title":"A survey on rag meeting llms: Towards retrieval-augmented large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:13.604740Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:8e55ebf97768518c1b541d8692e6c21223663aa646accc0b95a8f71c1b1e00dd","observation_id":"adc96400-63b3-4643-8c91-197ec2c2346a","resolution":{"observed_at":"2026-08-07T14:05:13.604740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:13.720735Z","title":"Retrieval augmented fact verification by synthesizing contrastive arguments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:13.720735Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:ef94fd36e88fc450923d303509180a71718fd476fe68d2d886cae3c3ea49793e","observation_id":"e86b0207-e6cd-41d8-805b-c3f27b249e55","resolution":{"observed_at":"2026-08-07T14:05:13.720735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:13.840604Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:13.840604Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:864157139c59a7d2dfcfa60319e75e6542f43ae919d7a0873b326c9dfb23d10c","observation_id":"3e9c8b11-82d9-486c-8ca2-aa22fe4e5236","resolution":{"observed_at":"2026-08-07T14:05:13.840604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:13.961513Z","title":"Enhancing retrieval-augmented large language models with iterative retrieval-generation synergy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:13.961513Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:aeb31018852f87c098b1bacbcfd2b4c04e2a2e69f13a8861d5cb41a5f1b93c84","observation_id":"564ba6a6-d365-43b2-a249-e898b9ec5788","resolution":{"observed_at":"2026-08-07T14:05:13.961513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:14.101879Z","title":"Is ChatGPT good at search? investigating large language models as re-ranking agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.101879Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:1841f5b40b40e7d1577cef67da99b324277b612ec64e302235578593aa8827c6","observation_id":"b30c650b-9b93-4cf6-a783-8292f8ca3181","resolution":{"observed_at":"2026-08-07T14:05:14.101879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04408","last_updated":"2023-10-06T17:55:36Z","snapshot_observed_at":"2026-08-05T10:28:11.033488Z","submitted_at":"2023-10-06T17:55:36Z","title":"RECOMP: Improving Retrieval-Augmented LMs with Compression and Selective Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04408","snapshot_observed_at":"2026-08-07T14:05:14.209452Z","title":"Recomp: Improving retrieval-augmented lms with compression and selective augmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.209452Z"},"links":{"cited_paper":"/paper/2310.04408","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:f3a28f70133136d90c98ac7dd161460fecbc6cb617b6bfd165c786f91175c7ec","observation_id":"f749abda-88f8-4111-8ce7-fba30db0e97b","resolution":{"observed_at":"2026-08-07T14:05:14.209452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-07T14:05:14.328036Z","title":"Retrieval-augmented generation for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.328036Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:978f5be36b2d0249f265d5fb60b0efbb0c491b99659d4ef0c76026b55fd5952c","observation_id":"e5524f22-fa16-43d2-8eb2-dc1d7c5b6c32","resolution":{"observed_at":"2026-08-07T14:05:14.328036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12566","last_updated":"2024-10-01T04:42:48Z","snapshot_observed_at":"2026-07-06T18:32:57.295918Z","submitted_at":"2024-06-18T12:52:51Z","title":"RichRAG: Crafting Rich Responses for Multi-faceted Queries in Retrieval-Augmented Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12566","snapshot_observed_at":"2026-08-07T14:05:14.402328Z","title":"Richrag: Crafting rich responses for multi-faceted queries in retrieval-augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.402328Z"},"links":{"cited_paper":"/paper/2406.12566","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:d36a07b9585fcda37e16e609ea74157069f89e28d10cd972cfaf984a62617971","observation_id":"18022728-b1e8-404a-b9df-d7ac85703d12","resolution":{"observed_at":"2026-08-07T14:05:14.402328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:14.507323Z","title":"Self-rag: Learn- ing to retrieve, generate, and critique through self-reflection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.507323Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:a74064a201055d7023e06b52f2f12a565356668975b804cb7bca451b3923d08a","observation_id":"b4242cff-c1ae-406c-ae82-a751886e402d","resolution":{"observed_at":"2026-08-07T14:05:14.507323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:14.634542Z","title":"Improving scientific document retrieval with concept coverage-based query set generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.634542Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:1ff578027208ee1f4a2cc1935df98a064458300f89be835e5867fab9385a0026","observation_id":"403ecb68-2e9c-4c34-adf4-9ac812c4c61d","resolution":{"observed_at":"2026-08-07T14:05:14.634542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01158","last_updated":"2025-01-24T20:09:39Z","snapshot_observed_at":"2026-08-04T15:18:29.851720Z","submitted_at":"2024-07-01T10:26:19Z","title":"Learning to Explore and Select for Coverage-Conditioned Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":"2407.01158","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.01158","snapshot_observed_at":"2026-08-07T14:05:23.367812Z","title":"Learning to Explore and Select for Coverage-Conditioned Retrieval-Augmented Generation","venue":"cs.CL","work_id":"caa6ef14-54b4-4b0e-9459-b49a02a74592","year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.689405Z"},"links":{"cited_paper":"/paper/2407.01158","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:bcaea8c39af3a10a2ed4328229a984e1dcb82607de1d62cec8563b3d301b1795","observation_id":"7f116a78-3f50-4a84-83cb-59ae9feaffda","resolution":{"observed_at":"2026-08-07T14:05:23.443794Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01558","last_updated":"2024-05-05T15:58:24Z","snapshot_observed_at":"2026-08-04T12:45:28.903998Z","submitted_at":"2023-10-02T18:52:35Z","title":"Making Retrieval-Augmented Language Models Robust to Irrelevant Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01558","snapshot_observed_at":"2026-08-07T14:05:14.775773Z","title":"Making retrieval-augmented language models robust to irrelevant context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.775773Z"},"links":{"cited_paper":"/paper/2310.01558","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:67a324c63410b9f0b40d3b917a72c91b05d80f392c0bbe002aa562ce60716c4f","observation_id":"3832d6c2-26d9-4e30-8961-94a402b53db2","resolution":{"observed_at":"2026-08-07T14:05:14.775773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15884","last_updated":"2024-10-07T02:19:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-29T04:36:39Z","title":"Corrective Retrieval Augmented Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15884","snapshot_observed_at":"2026-08-07T14:05:14.872395Z","title":"Corrective retrieval augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.872395Z"},"links":{"cited_paper":"/paper/2401.15884","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:b771f5cd83d921f4afea00118081120cfa8dce1ecf6655f20fb8f0a67058c61c","observation_id":"be3ea4e6-b631-45bb-9fed-7890a5240b3c","resolution":{"observed_at":"2026-08-07T14:05:14.872395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02485","last_updated":"2024-07-02T17:59:17Z","snapshot_observed_at":"2026-08-07T22:02:41.295637Z","submitted_at":"2024-07-02T17:59:17Z","title":"RankRAG: Unifying Context Ranking with Retrieval-Augmented Generation in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02485","snapshot_observed_at":"2026-08-07T14:05:14.960186Z","title":"Rankrag: Unifying context ranking with retrieval-augmented generation in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:14.960186Z"},"links":{"cited_paper":"/paper/2407.02485","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:4bfe95ec12a6dfbde8d33bd3376d58837ed1480fb14dccae2952c025fc19e80c","observation_id":"ae15d107-45ea-4c37-a614-45abd540b092","resolution":{"observed_at":"2026-08-07T14:05:14.960186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.051634Z","title":"Query rewriting in retrieval- augmented large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.051634Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:04c3584455d23be015a5705a09f3443c854c8189df075231dfa884e74517fefe","observation_id":"23a6c6c7-fb03-47e1-82fd-822a0f25da3a","resolution":{"observed_at":"2026-08-07T14:05:15.051634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05008","last_updated":"2024-10-24T10:41:23Z","snapshot_observed_at":"2026-07-06T18:11:30.354072Z","submitted_at":"2024-05-08T12:24:52Z","title":"ADELIE: Aligning Large Language Models on Information Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05008","snapshot_observed_at":"2026-08-07T14:05:15.142842Z","title":"Adelie: Aligning large language models on information extraction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.142842Z"},"links":{"cited_paper":"/paper/2405.05008","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:79b794aa67970f074b1cc88c87e12358eb133ebc49023855b32028b89a6e7f88","observation_id":"11d34376-c027-4b11-ac95-d51ec730818d","resolution":{"observed_at":"2026-08-07T14:05:15.142842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13509","last_updated":"2025-03-04T06:12:01Z","snapshot_observed_at":"2026-08-04T17:01:43.796596Z","submitted_at":"2024-10-17T12:53:29Z","title":"RAG-DDR: Optimizing Retrieval-Augmented Generation Using Differentiable Data Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13509","snapshot_observed_at":"2026-08-07T14:05:15.221679Z","title":"Rag-ddr: Optimizing retrieval-augmented generation using differen- tiable data rewards","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.221679Z"},"links":{"cited_paper":"/paper/2410.13509","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:bed59aea35724c6b2b44cfacc31c09a19941e717463eac292edc114951cef226","observation_id":"236c859c-c924-4d43-bced-2e6d90b8bf92","resolution":{"observed_at":"2026-08-07T14:05:15.221679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.289783Z","title":"Importance sampling: a review","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.289783Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:0d9e295aa6e655f9be820c7d8fdcc48f48c6b93c8b0b86d4783a0803bcfa95b5","observation_id":"82c3bf84-21c7-4bcb-bbad-fe2e0acf35c8","resolution":{"observed_at":"2026-08-07T14:05:15.289783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.371836Z","title":"Looking for information: A survey of research on information seeking, needs, and behavior","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.371836Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:36906f0acce10e1b65dbb4c1deb72dd32a158d8ffdc1a0dd56d27c0622b2a6fb","observation_id":"d4afa604-d503-4822-b424-27d49843da29","resolution":{"observed_at":"2026-08-07T14:05:15.371836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09713","last_updated":"2025-02-23T03:23:46Z","snapshot_observed_at":"2026-08-05T07:48:17.311058Z","submitted_at":"2024-10-13T03:45:24Z","title":"Agentic Information Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09713","snapshot_observed_at":"2026-08-07T14:05:15.445008Z","title":"Agentic information retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.445008Z"},"links":{"cited_paper":"/paper/2410.09713","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:0d3bafd2fcfafd61c832ea00b2aa1050844e322afc078ff8d1610b9d950f0bf7","observation_id":"d82cd82d-b496-452b-bfb6-320c3153a5ef","resolution":{"observed_at":"2026-08-07T14:05:15.445008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.501666Z","title":"Exploratory search: from finding to understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.501666Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:8eca94472c608b1b7d89cfa74964022efbbcefc2b163bd8c404c56af5a8b5b82","observation_id":"de230e1f-c273-4f83-b588-424b09be4c75","resolution":{"observed_at":"2026-08-07T14:05:15.501666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.550171Z","title":"The expectation-maximization algorithm","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.550171Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:aa1d548e115d235e5b6d3f1e6236fb5a03e2ccc2a19ad741385909a828eb184e","observation_id":"a2289089-a28f-42d8-a5df-f1e2c15e2312","resolution":{"observed_at":"2026-08-07T14:05:15.550171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.619404Z","title":"Variational reasoning about user preferences for conversa- tional recommendation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.619404Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:aa6794af9f55394990913caf6c47f0a3c279d5211af5a4b8596b7519254a86a3","observation_id":"e64856a3-434d-406d-928d-8e1ab369f88e","resolution":{"observed_at":"2026-08-07T14:05:15.619404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.678807Z","title":"Variational reasoning over incomplete knowledge graphs for conversational recommendation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.678807Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:a02c713f9222adf73cdec9da5dfa062238425f7d643b31719913e10348fef85e","observation_id":"c848aaf0-fccc-442c-85dc-f3e9b33d2bfb","resolution":{"observed_at":"2026-08-07T14:05:15.678807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05407","last_updated":"2022-03-31T16:00:14Z","snapshot_observed_at":"2026-07-06T10:40:09.203717Z","submitted_at":"2021-02-10T12:50:38Z","title":"Advances in Importance Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05407","snapshot_observed_at":"2026-08-07T14:05:15.766679Z","title":"Advances in importance sampling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.766679Z"},"links":{"cited_paper":"/paper/2102.05407","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:2d6235c78b580ad2dd48c512acdc4b0df9b5bc690353957845c18977d33a51a2","observation_id":"3871ef53-9b38-4752-8aea-40ca93b15aca","resolution":{"observed_at":"2026-08-07T14:05:15.766679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.818594Z","title":"Axiomatisations of the average and a further generalisation of monotonic sequences","venue":null,"work_id":null,"year":1974},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.818594Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:8f5d2a2153121841057fff61f8c05b7709ba7de63ac2cefe623728d9bbe1d661","observation_id":"111f4eb8-d080-4cd4-9e19-8845b7a73e62","resolution":{"observed_at":"2026-08-07T14:05:15.818594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.869809Z","title":"Retrieval-augmented generation for knowledge-intensive nlp tasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.869809Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:2dfcbd73b10b91b7a7a9fb1c3aa90af8743005776e17dd69b81ef7c89b6dd065","observation_id":"5546e1a0-7a6b-41f7-9e8f-5c1a4eab3b68","resolution":{"observed_at":"2026-08-07T14:05:15.869809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:15.955912Z","title":"Search-in-the-chain: Towards accurate, credible and traceable large language models for knowledge-intensive tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:15.955912Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:03d137fac21aa6a9a6ae895a8e6d5f378c6f7d5b804b743dbb6201ac6c315eb0","observation_id":"4dec3ef6-87ca-430b-8990-5257c114f79a","resolution":{"observed_at":"2026-08-07T14:05:15.955912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:16.054509Z","title":"Stochastic rag: End-to-end retrieval-augmented generation through expected utility maximization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.054509Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:e05eceb743f9a9ebd2e5dbc67a172367df16b693db4dcca9920fee72733de778","observation_id":"4153c0c0-f540-4f13-b274-014d88e74e2c","resolution":{"observed_at":"2026-08-07T14:05:16.054509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:16.146896Z","title":"Investigating the factual knowledge boundary of large language models with retrieval augmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.146896Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:edb3f8788c8e8a9d12e61b095f63cb1f6f5cb73cbf8c4efb4e7ae9b01732371a","observation_id":"49550ee4-072b-409a-a230-e445f23b84b9","resolution":{"observed_at":"2026-08-07T14:05:16.146896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:16.199702Z","title":"Natural questions: A benchmark for question answering research","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.199702Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:1d40e1f104f086427a420c62331e8032b6d69826ac67ac635693a42cd28d779c","observation_id":"0ae85c51-3915-4eee-ab9e-5308abbc6be6","resolution":{"observed_at":"2026-08-07T14:05:16.199702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:28.700605Z","title":"Cohen, Ruslan Salakhut- dinov, and Christopher D","venue":null,"work_id":"421d80d4-2a1b-44da-b9b6-6049b07bf042","year":2018},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.244374Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:14ba98f716bb449197fb69dd82d0e472e5b489b19508891afb256f4d7a267cbb","observation_id":"4f393b02-9174-4f78-bd8f-85660f61b316","resolution":{"observed_at":"2026-08-07T14:05:28.768832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:28.499754Z","title":"MuSiQue: Multihop questions via single-hop question composition","venue":null,"work_id":"f4f552ba-b0bf-4348-9737-54770bf50462","year":2022},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.305462Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:0dd032c15db8cd7510e1d175a8dec29ece7d42dd59ceae69c71607cb90a7fd11","observation_id":"465c7b3f-0f28-42d8-962a-899ac6ac6f5d","resolution":{"observed_at":"2026-08-07T14:05:28.580383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:28.350920Z","title":"Constructing a multi-hop QA dataset for comprehensive evaluation of reasoning steps","venue":null,"work_id":"38441b4d-a266-4e9a-8544-79fe937f37ba","year":2020},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.380631Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:cd0b73c74982bc1e9d2f22b2e0702aca7a37ca8d4436659d7cbc373b6bdac383","observation_id":"ff9f31fe-f667-47ed-81f5-63ccb0d00e45","resolution":{"observed_at":"2026-08-07T14:05:28.428699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:28.209433Z","title":"KILT: a benchmark for knowledge intensive language tasks","venue":null,"work_id":"6d6a7a1d-7590-4cc5-9798-1839136c9148","year":2021},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.433386Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:d0f12d730d71f2930008faf51964c884c91853318fbd0eda91e4b5f7903192e4","observation_id":"e49d750b-c474-480d-8c43-8e400caf21a7","resolution":{"observed_at":"2026-08-07T14:05:28.264514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:05:16.476062Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.476062Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:1bb8ac45615a604d32094862c575b7b4929acff1a56c64842dc7b96b62c69e40","observation_id":"e187fb5e-88f4-4351-ae83-436ade168513","resolution":{"observed_at":"2026-08-07T14:05:16.476062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:16.524672Z","title":"Introducing ChatGPT, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.524672Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:27f4067a5ff30671f3ac4e1e8d176eab39be718bf7e432d8cde5d1e5705af2bc","observation_id":"34858bcb-ca8a-438e-a289-b78a58c72575","resolution":{"observed_at":"2026-08-07T14:05:16.524672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:05:16.589932Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.589932Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:b41a3924310076a9f90fba4dbcfab22d39c2fd701562d43291986690b71728da","observation_id":"133cff93-95cc-4b44-9dfa-8e63c60e23f7","resolution":{"observed_at":"2026-08-07T14:05:16.589932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:16.647669Z","title":"Qwq: Reflect deeply on the boundaries of the unknown, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.647669Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:11232badd3f3010d317778a07b9c1bcd68a99f6623088b6dfe322590a617cd53","observation_id":"e88cab87-5c98-411d-89dc-ae764b56dbad","resolution":{"observed_at":"2026-08-07T14:05:16.647669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:05:16.703077Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.703077Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:432e0b69367a9f56dc6786462f1c70177a84b6311ae54d6816f2216bc35980fb","observation_id":"9e31cba3-abf5-4f73-aaa1-94fb99280351","resolution":{"observed_at":"2026-08-07T14:05:16.703077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:27.987479Z","title":"Mistral 7b","venue":null,"work_id":"6606a581-877c-405f-9867-95eae18ef43b","year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.776602Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:a3fd7e3c643a20092bf7dbcc786081cff08bb2cfe110a7b463b530c16b581907","observation_id":"adc73a35-386a-4c74-a1b0-a813ee3a6fb3","resolution":{"observed_at":"2026-08-07T14:05:28.068583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10225","last_updated":"2024-10-30T02:58:14Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2024-01-18T18:59:11Z","title":"ChatQA: Surpassing GPT-4 on Conversational QA and RAG","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10225","snapshot_observed_at":"2026-08-07T14:05:16.838616Z","title":"Chatqa: Surpassing gpt-4 on conversational qa and rag","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.838616Z"},"links":{"cited_paper":"/paper/2401.10225","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:35fef4fbdf073002016b05e611345216fc80eeb9c83b9d6496b11089c5426d3f","observation_id":"31cc3cf0-3695-4780-ab21-dec89dfa84e9","resolution":{"observed_at":"2026-08-07T14:05:16.838616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:27.818357Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"6908b0f3-d014-42af-9e72-83201a651e48","year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.917846Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:f578726b204ddecffd0b97f1d6ed66eec097c43adf443e33066f9d5f861e5e6a","observation_id":"bd41e7e5-223b-4364-92d0-ba1398ce3c6a","resolution":{"observed_at":"2026-08-07T14:05:27.884301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:27.644489Z","title":"InstructRAG: Instructing retrieval-augmented generation via self-synthesized rationales","venue":null,"work_id":"a71a75b6-a042-4e18-b0a6-f7bf6946d5da","year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:16.978447Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:071379743219f2b0db903e68a7e40f7ddfb8bb78aba5cc69b064881c5f337873","observation_id":"514f7c74-d7a2-4edd-bc04-0e566acf78c9","resolution":{"observed_at":"2026-08-07T14:05:27.731300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14891","last_updated":"2024-09-16T17:15:52Z","snapshot_observed_at":"2026-08-04T07:51:30.943267Z","submitted_at":"2024-06-21T06:26:38Z","title":"Generate-then-Ground in Retrieval-Augmented Generation for Multi-hop Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14891","snapshot_observed_at":"2026-08-07T14:05:17.020611Z","title":"Generate-then-ground in retrieval-augmented generation for multi-hop question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.020611Z"},"links":{"cited_paper":"/paper/2406.14891","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:f2c80fbcf6fe8eca44951a62518fa45c3c3109376b5daaef48e4d09330db19e8","observation_id":"27ca1651-e090-489c-bab4-27216c6b16bf","resolution":{"observed_at":"2026-08-07T14:05:17.020611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:27.459760Z","title":"Khattab, Arnav Singhvi, Paridhi Maheshwari, Zhiyuan Zhang, Keshav Santhanam, Sri Vardhamanan, Saiful Haq, Ashutosh Sharma, Thomas T","venue":null,"work_id":"f498566a-31e5-4add-ba05-97e7c198c57c","year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.070130Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:5e7083098e9f48220809964d8c67334969c45dfb34bb1e57c672df67b35c087f","observation_id":"0e106eb4-734e-405d-bff0-2044c139ca5d","resolution":{"observed_at":"2026-08-07T14:05:27.533295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03268","last_updated":"2023-05-05T03:49:14Z","snapshot_observed_at":"2026-07-06T15:23:33.023871Z","submitted_at":"2023-05-05T03:49:14Z","title":"Verify-and-Edit: A Knowledge-Enhanced Chain-of-Thought Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03268","snapshot_observed_at":"2026-08-07T14:05:17.111946Z","title":"Verify-and-edit: A knowledge-enhanced chain-of-thought framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.111946Z"},"links":{"cited_paper":"/paper/2305.03268","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:046b718aa6ee3e6b0d836c2126eb80a128e2c67472c2e8ca145b4a46cb454adf","observation_id":"03fdec90-2c6e-4fd4-9373-c6ba6bbd5e4e","resolution":{"observed_at":"2026-08-07T14:05:17.111946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11278","last_updated":"2024-03-26T16:40:50Z","snapshot_observed_at":"2026-08-04T17:14:43.892143Z","submitted_at":"2023-07-21T00:34:38Z","title":"Generator-Retriever-Generator Approach for Open-Domain Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.11278","snapshot_observed_at":"2026-08-07T14:05:17.173975Z","title":"Generator-retriever-generator approach for open- domain question answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.173975Z"},"links":{"cited_paper":"/paper/2307.11278","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:73e3e043eeac86d0e84309eaa86e7aa151aa50fcb8f441ac1ad78c9d4b1b5dfe","observation_id":"28e4d4fd-efb9-42c1-9c84-da1b3b43bda4","resolution":{"observed_at":"2026-08-07T14:05:17.173975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-07T14:05:17.295501Z","title":"Search-o1: Agentic search-enhanced large reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.295501Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:63fd955212b34ff1952c7a817215004f5b5a2e098478f3f109561c672bc63bec","observation_id":"faee4197-a6e6-40eb-8c83-81a5d6cc91f5","resolution":{"observed_at":"2026-08-07T14:05:17.295501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-07T14:05:17.419701Z","title":"Search-r1: Training llms to reason and leverage search engines with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.419701Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:381ea1765d68e3a347b27ea72fcd6df2086cabf31a711b94c37c08c3f786d3a9","observation_id":"d6e93ec4-960b-4799-b03a-1543a5d4ef33","resolution":{"observed_at":"2026-08-07T14:05:17.419701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:05:17.509517Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.509517Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:4b1548f7d5ea1dce252f2bee98ccc432ab31e892ffbb911974433060a1c91ae2","observation_id":"4109adfe-41ff-46d8-adbd-be3ed63b68a6","resolution":{"observed_at":"2026-08-07T14:05:17.509517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:27.190226Z","title":"Khattab, Jon Saad-Falcon, Christopher Potts, and Matei A","venue":null,"work_id":"e3021eaf-96f8-4bf4-8a7b-7b98e2371384","year":2021},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.605346Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:71d7dd1bc48e54f941e96cea546f815f281575bde0b9e52830abcbb0e97e4b06","observation_id":"a6a24f9e-d8af-46af-bb47-9394d1f92432","resolution":{"observed_at":"2026-08-07T14:05:27.306823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-07T14:05:17.716407Z","title":"R1-searcher: Incentivizing the search capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.716407Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:60090b8b58cf0df96770c39a479fd15bdbd790108f0ca244db706817d4ae93f5","observation_id":"f6587142-9a88-4ab7-be68-9023c302abfd","resolution":{"observed_at":"2026-08-07T14:05:17.716407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18111","last_updated":"2024-10-08T06:37:03Z","snapshot_observed_at":"2026-08-04T00:55:03.768418Z","submitted_at":"2024-05-28T12:18:50Z","title":"ATM: Adversarial Tuning Multi-agent System Makes a Robust Retrieval-Augmented Generator","version":3},"cited_work":{"arxiv_id":"2405.18111","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.18111","snapshot_observed_at":"2026-08-07T14:05:22.886486Z","title":"ATM: Adversarial Tuning Multi-agent System Makes a Robust Retrieval-Augmented Generator","venue":"cs.CL","work_id":"9f86e6f2-1c6d-48fb-9313-4de16dcf74ee","year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.830397Z"},"links":{"cited_paper":"/paper/2405.18111","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:0dd5bf7b078b3024f397ec965b4d511f804c68325572a64fc702c6ee6d2b9a3d","observation_id":"e89b56f0-f66f-4bbc-8ce0-9d2d917c62a8","resolution":{"observed_at":"2026-08-07T14:05:22.961845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:17.926793Z","title":"Improving retrieval-augmented generation through multi-agent reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:17.926793Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:e7a114ee258751f16cd223c2d025c8a29e37ca7131ab78a74db24594a18d34cb","observation_id":"cc51be44-06e3-4767-8394-a48886d1eae8","resolution":{"observed_at":"2026-08-07T14:05:17.926793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:27.029544Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":"b8a8aad4-4782-423d-a223-a6623525298d","year":2020},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.032176Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:e52e8267eb29f5866088aea86f9f0fd988e0f68dc44377d18e091a759979fe5f","observation_id":"8f17bb09-e43d-4c9e-9fbd-83fa26f1ce2b","resolution":{"observed_at":"2026-08-07T14:05:27.094615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T14:05:18.095454Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.095454Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:822399ba6e13e0efb4e47386b57d66bac82d84061d9b7d010e77f9fc0f1a4e24","observation_id":"3afe644a-310d-4720-b19e-8d830e577397","resolution":{"observed_at":"2026-08-07T14:05:18.095454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:26.863559Z","title":"Interleaving retrieval with chain-of-thought reasoning for knowledge-intensive multi-step questions","venue":null,"work_id":"4aee53fb-a919-4568-84a1-626b305546d0","year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.189736Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:201660ebe4134c9b8292d6be26173b36eb1e90cce58eb6269dd4f21129b2289a","observation_id":"fd8cd45b-9b92-4beb-9d5e-47fb8bdd6049","resolution":{"observed_at":"2026-08-07T14:05:26.926645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:26.730931Z","title":null,"venue":null,"work_id":"8b95ae94-9d76-4671-9287-9b0c3e46caa3","year":2020},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.277837Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:cf25daef8144739a738a776d408fb2d676b00bf0b8493d88274ced18e2638498","observation_id":"06dc0a60-0eb8-4833-b940-3f40b7d0a2f5","resolution":{"observed_at":"2026-08-07T14:05:26.795141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:26.483826Z","title":"Document ranking with a pretrained sequence-to-sequence model","venue":null,"work_id":"a3216883-9ad2-40f8-83f0-f0e1fc35dfd2","year":2020},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.361196Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:3424a83f42a5ac4221a6d150bd3080cdd4c33fc26402219fdab0bf0008c40438","observation_id":"dc4cd457-e7bd-40c1-91a9-dd58cfd94a56","resolution":{"observed_at":"2026-08-07T14:05:26.609280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:18.496336Z","title":"C-pack: Packaged resources to advance general chinese embedding, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.496336Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:5b7b081193d4f42c953c2a781114a92b6f61af1c8a30bd940f3f82e598ac1a82","observation_id":"350f93f6-85b3-40d4-9501-402029d07eac","resolution":{"observed_at":"2026-08-07T14:05:18.496336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15088","last_updated":"2023-09-26T17:31:57Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:31:57Z","title":"RankVicuna: Zero-Shot Listwise Document Reranking with Open-Source Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15088","snapshot_observed_at":"2026-08-07T14:05:18.558566Z","title":"Rankvicuna: Zero-shot listwise document reranking with open-source large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.558566Z"},"links":{"cited_paper":"/paper/2309.15088","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:07a3bbd4507fbfc0ba415a10d51aabcad8c0935454b98f143bc4d31ac821e027","observation_id":"05d38201-8e9c-4ca5-b4c4-e8c583aaee30","resolution":{"observed_at":"2026-08-07T14:05:18.558566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-04T15:34:23.322583Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T14:05:18.668363Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.668363Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:e828bc8574e66e4aa34fc941f42c6fdfe245d8478fe546617c723b9cd83f7125","observation_id":"aaa81709-b90d-4fe2-8dc2-c629d0d6ce3d","resolution":{"observed_at":"2026-08-07T14:05:18.668363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:26.230464Z","title":"Information retrieval: recent advances and beyond","venue":null,"work_id":"50408e0c-2326-4bd7-99b2-0e5c373e4acc","year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.759424Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:fdca74093bb3b90a8cfb0977f0bea9d172667590fcbf1a3892aa095237b54864","observation_id":"bdc7e734-ab60-4aac-a809-488ad3eaf95a","resolution":{"observed_at":"2026-08-07T14:05:26.353257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18150","last_updated":"2024-06-12T03:21:15Z","snapshot_observed_at":"2026-08-05T02:38:50.168738Z","submitted_at":"2024-02-28T08:24:38Z","title":"Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18150","snapshot_observed_at":"2026-08-07T14:05:18.826562Z","title":"Unsupervised information refinement training of large language models for retrieval-augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.826562Z"},"links":{"cited_paper":"/paper/2402.18150","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:4c9e0bcf6e80b1180cfa172cd21bff9c2e9f2963610627a104fba205e6886585","observation_id":"9a20189a-be06-43d6-a536-4e59b3468c92","resolution":{"observed_at":"2026-08-07T14:05:18.826562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:18.892905Z","title":"Large language models for generative information extraction: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.892905Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:ac875c44e9c1a52c13411c00bf40df8043d1ec55005b0fbbb719a0e6a9c48704","observation_id":"962e23c2-5be7-44c3-a0af-8b5ac4f12143","resolution":{"observed_at":"2026-08-07T14:05:18.892905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-07T14:05:18.985725Z","title":"Demystifying long chain-of-thought reasoning in llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.985725Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:4a6d44b7c04e954fc4e4231afb24c5c9edb11973efac52dd28eb717b1418d481","observation_id":"cbe1b398-96a0-4b10-af76-e5e33ef7818b","resolution":{"observed_at":"2026-08-07T14:05:18.985725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-07T14:05:19.097980Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.097980Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:6fd398b01cda75702abc7bb4e5a977b271dd89bff1a7c2dee0aeb5cc3e3a1963","observation_id":"873e8b5f-7c22-4b69-83dd-7f47a805c369","resolution":{"observed_at":"2026-08-07T14:05:19.097980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:26.051943Z","title":"Xia, Quoc Le, and Denny Zhou","venue":null,"work_id":"4d8a9090-ce92-4b68-a0bd-bd70fbec4f89","year":2022},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.212617Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:3e8591e61e06c4595522660ae8774a63a29eb36cf60a12d4d462da83cb716abf","observation_id":"df7ab4bd-f78c-405e-819e-b478340fa328","resolution":{"observed_at":"2026-08-07T14:05:26.122112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09597","last_updated":"2023-09-18T10:47:13Z","snapshot_observed_at":"2026-07-06T14:32:29.720436Z","submitted_at":"2022-12-19T16:32:42Z","title":"Reasoning with Language Model Prompting: A Survey","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09597","snapshot_observed_at":"2026-08-07T14:05:19.282572Z","title":"Reasoning with language model prompting: A survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.282572Z"},"links":{"cited_paper":"/paper/2212.09597","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:435475126b32123e21bbeb8761abbeb6ed0bc8b2899247619e19b32ea1f1ec62","observation_id":"0a4b7a2c-ad48-4b13-bd84-4d8a6b1918dd","resolution":{"observed_at":"2026-08-07T14:05:19.282572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-07T14:05:19.390614Z","title":"Towards large reasoning models: A survey of reinforced reasoning with large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.390614Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:8f0ea17a81e5deda37ddb7193456c1cd06672de03f7548952d6760b7ab4cf4d5","observation_id":"68611013-2f1a-4d71-aa5e-e82cc35bbc04","resolution":{"observed_at":"2026-08-07T14:05:19.390614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:19.501659Z","title":"Reasoning with large language models, a survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.501659Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:ece487ac0125d8203418e744c7dbbec84c45682995ef5f1f3838866b39bcc343","observation_id":"a28bfe5f-fcc9-4719-9fc4-627aff186c07","resolution":{"observed_at":"2026-08-07T14:05:19.501659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:19.566483Z","title":"Thinking, fast and slow","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.566483Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:e94015269ecfbc67a87ae772c85c31f875e95c3c169ea4a9b1be30ae88f7c323","observation_id":"745c6d4c-16b2-42cf-87a4-2134f481ee93","resolution":{"observed_at":"2026-08-07T14:05:19.566483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:19.699152Z","title":"Learning more effective representations for dense retrieval through deliberate thinking before search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.699152Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:40452309ba2066bd4bf0708841dcaa8bd4052f1e073f30cd1fe7e3bc7c6565e9","observation_id":"cf60d922-fc46-4c42-9e81-1078b21e22f8","resolution":{"observed_at":"2026-08-07T14:05:19.699152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:25.847301Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":"cda29019-c710-41f6-b817-d7a392e3c07e","year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.832333Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:a2cf34f6e25961c1078d94534fd2205cac27f408c0425ed2bcc060765e36824f","observation_id":"2a8e76e5-4373-4881-9e15-045e5d0ef79e","resolution":{"observed_at":"2026-08-07T14:05:25.946846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:05:19.912405Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.912405Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:a5debc3598339e4593617857f7c35b0e1eeb10973051e2168b0184c7a489013b","observation_id":"b9c7efcb-3bbe-4964-afae-9b013e852031","resolution":{"observed_at":"2026-08-07T14:05:19.912405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-07T14:05:19.980478Z","title":"Program of thoughts prompting: Disentangling computation from reasoning for numerical reasoning tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:19.980478Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:4e0a31794d4685c5fe0632839892f91acecff7a51e3079bd91e2024db49e9d4b","observation_id":"e6db7d1f-9cc8-4e6e-af76-db7bf03b8972","resolution":{"observed_at":"2026-08-07T14:05:19.980478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-08-07T20:40:27.882593Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-07T14:05:20.079725Z","title":"Torl: Scaling tool-integrated rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.079725Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:b1cab690b9b71caa8a2073c55f639fff19cbf75140b8b34f108c95f1aee40881","observation_id":"5ce54d20-9228-4fce-bc41-0c6183dc2f59","resolution":{"observed_at":"2026-08-07T14:05:20.079725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08105","last_updated":"2025-04-07T21:05:50Z","snapshot_observed_at":"2026-07-06T19:31:18.802964Z","submitted_at":"2024-10-10T16:53:10Z","title":"What Makes Large Language Models Reason in (Multi-Turn) Code Generation?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08105","snapshot_observed_at":"2026-08-07T14:05:20.181133Z","title":"What makes large language models reason in (multi-turn) code generation? arXiv preprint arXiv:2410.08105, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.181133Z"},"links":{"cited_paper":"/paper/2410.08105","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:d831013a02c05044242a3239423f36314c5e7a098f7071f9ce5f71ae49f06524","observation_id":"043e0442-330f-47a7-a69d-40cc69fcc8d8","resolution":{"observed_at":"2026-08-07T14:05:20.181133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-07T14:05:20.249956Z","title":"A survey on large language models for code generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.249956Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:dd5cef07cf883cbdf0963add1669af21c22bda030de9e97280919a30e9b780dc","observation_id":"2aed8c31-32d0-41d6-b11e-8775cac783dc","resolution":{"observed_at":"2026-08-07T14:05:20.249956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:25.679672Z","title":"In-context retrieval-augmented language models","venue":null,"work_id":"18f93518-1291-4a87-9d77-ef8533c59a57","year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.356926Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:b309e5c670f3522f279cba0849d82cb70d1a679da808695644e14677aaf29ace","observation_id":"ee6f0306-911a-4a87-97f1-9858001a6b9d","resolution":{"observed_at":"2026-08-07T14:05:25.757113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:25.504876Z","title":"Multi-level information retrieval augmented generation for knowledge-based visual question answering","venue":null,"work_id":"4ed370cd-11ca-42f1-9dc1-81a5fa0f8d77","year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.447101Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:ba724705f0a8b262ba3b22084629eabdf99fc0d03b101c0bd8e31c55a7b5589b","observation_id":"90954161-bac9-4aac-96df-e2156f63e600","resolution":{"observed_at":"2026-08-07T14:05:25.585253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02525","last_updated":"2018-10-05T05:52:49Z","snapshot_observed_at":"2026-07-06T07:06:15.247487Z","submitted_at":"2018-10-05T05:52:49Z","title":"Where Did My Optimum Go?: An Empirical Analysis of Gradient Descent Optimization in Policy Gradient Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02525","snapshot_observed_at":"2026-08-07T14:05:20.556615Z","title":"Where did my optimum go?: An em- pirical analysis of gradient descent optimization in policy gradient methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.556615Z"},"links":{"cited_paper":"/paper/1810.02525","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:0ec5579b3921ec393a691e3d283e5fe3290b9eb91084775fa0984adc02b8879f","observation_id":"99c6a4c4-ac1e-404c-9774-4c117adfa27d","resolution":{"observed_at":"2026-08-07T14:05:20.556615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:25.308794Z","title":"The 37 implementation details of proximal policy optimization","venue":null,"work_id":"79100685-7f5e-46b8-9930-d47a26b4ceb9","year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.654836Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:a0f1c9ad1f180411318c500bc631a19c93f7c7eda0b0a09326e42447b0ea20fd","observation_id":"1c0b9061-af77-4eeb-8c8c-6927d53d6e75","resolution":{"observed_at":"2026-08-07T14:05:25.416719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03479","last_updated":"2023-06-08T07:43:05Z","snapshot_observed_at":"2026-08-07T11:53:30.488687Z","submitted_at":"2021-02-06T02:28:09Z","title":"Rethinking the Implementation Tricks and Monotonicity Constraint in Cooperative Multi-Agent Reinforcement Learning","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.03479","snapshot_observed_at":"2026-08-07T14:05:20.768390Z","title":"Rethinking the implementation tricks and monotonicity constraint in cooperative multi-agent reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.768390Z"},"links":{"cited_paper":"/paper/2102.03479","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:23e9eaa3a59bb1cc5825d77e848b4fdd000d508078a6f2533847a9f41cf21d02","observation_id":"2416dc8f-1b34-47c4-863b-59cec1a61a9e","resolution":{"observed_at":"2026-08-07T14:05:20.768390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-07-06T19:46:24.121362Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-07T14:05:20.874472Z","title":"Language models are hidden reasoners: Unlocking latent reasoning capabilities via self-rewarding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.874472Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:7584a63d50fc8f601786d483617a750114cad48451ca34671766a091690ad8b6","observation_id":"4f4b8e15-5e15-4a2f-ad02-412bf176573e","resolution":{"observed_at":"2026-08-07T14:05:20.874472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-07T14:05:20.983397Z","title":"Meta-rewarding language models: Self-improving alignment with llm-as-a-meta-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:20.983397Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:8458b7d129367ab533884634ded3d0ea4a01ac12ce1950d65ea52ffeb23eae2d","observation_id":"f60556ac-df75-4b36-bca0-634d49709598","resolution":{"observed_at":"2026-08-07T14:05:20.983397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:25.145715Z","title":"Co-Reyes, Rishabh Agarwal, Ankesh Anand, Piyush Patil, Peter J","venue":null,"work_id":"de422d75-d100-422b-b187-97d1821d0c7d","year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.074154Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:fb2d85bd60f569f8cebe4c514b09ff3a3c34a7191cce271136795cb2b38f61a5","observation_id":"314c94a9-23a3-49de-b72c-4bc791ddc031","resolution":{"observed_at":"2026-08-07T14:05:25.233091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:25.016262Z","title":"Buy 4 reinforce samples, get a baseline for free! In The International Conference on Learning Representations, 2019","venue":null,"work_id":"4dad976b-59a3-438d-b586-fba5db63fc5f","year":2019},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.131733Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:4e28570e43ab3b604ef8daf57f7bc592153f1b149418d2781673a62029dca550","observation_id":"1dd17e79-8ded-4bbd-9def-ca1e8587e616","resolution":{"observed_at":"2026-08-07T14:05:25.086933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:24.752256Z","title":"Sample efficient reinforce- ment learning with reinforce","venue":null,"work_id":"43db6824-4c00-4a16-b900-59e464edfcdc","year":2021},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.185424Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:80848f5bd825b86fdb13eefb64c7a34da62ba2d4cde22c83f6dc6e536e7d5b70","observation_id":"e1e96db9-c7f2-4856-ba4a-5b5ec1ae25b2","resolution":{"observed_at":"2026-08-07T14:05:24.913057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-07T14:05:21.303489Z","title":"Self-play fine-tuning converts weak language models to strong language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.303489Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:3ce45668c8beee762e966a6464f3fc9a248784b2f80cbfdbb8ee562a5bce3fb8","observation_id":"f791314f-9f7f-4579-82a3-2c2c52266bf3","resolution":{"observed_at":"2026-08-07T14:05:21.303489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:24.624700Z","title":null,"venue":null,"work_id":"8ab3887f-b847-4df0-9821-abc4451e80e5","year":1997},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.409552Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:95260de93941b76a99429afc40bc99380bbd0c35b2e7a506b8df80b9d743c64f","observation_id":"edcf6b16-c05b-4cea-a03d-1406eefcc219","resolution":{"observed_at":"2026-08-07T14:05:24.679944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:24.496848Z","title":"Corpuslm: Towards a unified language model on corpus for knowledge-intensive tasks","venue":null,"work_id":"5e020c86-d69b-4b33-8db5-356a968d5f75","year":2024},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.494664Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:7835bfb5ecc7b9dd8e5d129c6a41cc23d7e7647333e24913da5f1522e6e8f76f","observation_id":"3571f04b-3892-4905-ae8a-ef7477920f2b","resolution":{"observed_at":"2026-08-07T14:05:24.556898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:24.393802Z","title":"Rade: Reference-assisted dialogue evaluation for open-domain dialogue","venue":null,"work_id":"103e6029-2f3a-4313-b1e5-fb61f5711210","year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.595764Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:154457afa59f93ab17c82f1a0e238467d97be52e3db87691f4b6bad4c6624872","observation_id":"b6bd6886-13ec-472b-934b-e0306a6b1a75","resolution":{"observed_at":"2026-08-07T14:05:24.433384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:24.307118Z","title":null,"venue":null,"work_id":"f7326224-adcf-4892-b2c8-916122dc292b","year":null},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.692757Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:5fbc911bc4897bcb4d8dc8eff7ea5db76589ddc7d8ac33342b4e4163fb564e0b","observation_id":"7846173b-5f85-4cbc-af8b-e625eef41164","resolution":{"observed_at":"2026-08-07T14:05:24.338093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:24.193273Z","title":null,"venue":null,"work_id":"c2320a15-8a15-48f9-bc11-63c12890be04","year":null},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.779573Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:2cc709eab3c114cb01c074b197068f1ca11f09b464bdca98435789c8bafd30c8","observation_id":"7d4838ef-3190-40fb-b040-a0a7542ba834","resolution":{"observed_at":"2026-08-07T14:05:24.233494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:23.948749Z","title":"Please start with a special token ` < Final > ` followed by the final answer","venue":null,"work_id":"6c0c2c80-10ad-491d-a122-bea8ca7195fa","year":null},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.837022Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:cd5d71c8abb12560e61e1149cb40d87e364ffcabd6213cd94972d2cc1f09df9b","observation_id":"1c8e330f-d459-4d5d-b8ed-9263db8c44e6","resolution":{"observed_at":"2026-08-07T14:05:24.068341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:23.847447Z","title":"Godey ' s Lady ' s Book","venue":null,"work_id":"2730e880-057b-447e-b59b-8073c13a302d","year":null},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.902979Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:c54ed7ce591957e8b8593baa1754a46e0c8af9ce091538c1a50f0aa5d34ef236","observation_id":"73b575fb-650f-4c42-9a83-cd3d44211008","resolution":{"observed_at":"2026-08-07T14:05:23.891847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:05:23.720312Z","title":"Arthur ' s Magazine","venue":null,"work_id":"119ddd7c-49f2-46fd-a9fe-302aaca3138f","year":1989},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:21.985940Z"},"links":{"citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:c157f3c4ec9bd03c64a724d5f04c638997520a6a63f7eea1a6b2d20818cd72ff","observation_id":"a750a2c2-4c68-47ba-beec-11fd01eb4669","resolution":{"observed_at":"2026-08-07T14:05:23.791676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":72,"verified_exact":2,"verified_fuzzy":26},"total_outbound_references":101},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 101 outbound references and 3 inbound Pith citation observations for arXiv:2505.20128."}