{"as_of":"2026-08-08T18:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f13b93dfd0c616c68272edbd188eb88b72c61cb4596ddca67a4f2a619f3a0b34","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:27:44.330205Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2502.13957","last_updated":"2026-05-16T17:37:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:56:03Z","title":"Supervising the search process produces reliable and generalizable information-seeking agents","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T02:18:27.204122Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2502.13957"},"observation_digest":"sha256:5b7f523661e6b1ad70dea77b3ecb88442115900afd5651b40d80b949b68b7f61","observation_id":"92e40c64-c24d-435d-9768-d73dcd9df392","resolution":{"observed_at":"2026-05-23T02:22:25.425822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2504.01990","last_updated":"2025-08-02T12:44:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-31T18:00:29Z","title":"Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems","version":2},"reference_index":152,"source":"pdf_text","source_observed_at":"2026-05-22T21:39:49.832151Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2504.01990"},"observation_digest":"sha256:6969c9f1f5aa9c7336277e51fd3350b6763005b24e6a9bdcfc6e1899af5e4e34","observation_id":"63e574af-d708-4df1-9c00-db0f9766a112","resolution":{"observed_at":"2026-05-22T21:42:10.633193Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-07T13:24:50.943846Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22019","last_updated":"2025-06-03T05:28:55Z","snapshot_observed_at":"2026-08-07T13:14:56.558609Z","submitted_at":"2025-05-28T06:30:51Z","title":"VRAG-RL: Empower Vision-Perception-Based RAG for Visually Rich Information Understanding via Iterative Reasoning with Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:24:50.943846Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2505.22019"},"observation_digest":"sha256:e150742a6541ec945b9bb97a2e95c1d04af3c827aec4b5389b03c52d532845d8","observation_id":"f7548be0-6977-4d9b-8ed3-e540525ea30f","resolution":{"observed_at":"2026-08-07T13:24:50.943846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-07T12:40:07.713578Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning.arXiv preprint arXiv:2503.00223, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.713578Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e7f486f36ddcf4f9352271e365b95e9ef8750043c185c4b53072e445a9af5777","observation_id":"1ad0381e-b8c5-4f9d-a42d-14fa07e5d01c","resolution":{"observed_at":"2026-08-07T12:40:07.713578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-07T11:16:58.570880Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02911","last_updated":"2025-06-03T14:16:53Z","snapshot_observed_at":"2026-08-07T21:54:10.624273Z","submitted_at":"2025-06-03T14:16:53Z","title":"Cell-o1: Training LLMs to Solve Single-Cell Reasoning Puzzles with Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:16:58.570880Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2506.02911"},"observation_digest":"sha256:98a723cc385f55b00fbcf359aee865fe19bef40fa7314dc730a647f8d0cc8e4f","observation_id":"456875cc-aab0-41bf-88a4-46e23986080c","resolution":{"observed_at":"2026-08-07T11:16:58.570880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2506.08125","last_updated":"2026-04-16T20:47:09Z","snapshot_observed_at":"2026-08-08T02:06:11.938489Z","submitted_at":"2025-06-09T18:27:26Z","title":"Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T10:06:05.697342Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2506.08125"},"observation_digest":"sha256:28bca13cb2ebbfbfae9f9bd7b2f6cf1905eb9ca0276737b786b13bf250557e40","observation_id":"d650c154-9b6a-47ec-97db-02ba1e517737","resolution":{"observed_at":"2026-05-19T10:07:14.205834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-07T04:07:19.358923Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11603","last_updated":"2025-06-16T03:35:12Z","snapshot_observed_at":"2026-08-07T04:02:03.372973Z","submitted_at":"2025-06-13T09:17:36Z","title":"TongSearch-QR: Reinforced Query Reasoning for Retrieval","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:07:19.358923Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2506.11603"},"observation_digest":"sha256:a8fd9dc24e0d1d484208e3b8c1108855ecdab9cd4dd08f6ac2e3681955fb6dba","observation_id":"fbc2cd86-1f29-49da-81de-c5c269e04507","resolution":{"observed_at":"2026-08-07T04:07:19.358923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-06T23:26:56.686867Z","title":"Deepretrieval: Powerful query generation for information retrieval with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18096","last_updated":"2025-09-03T15:32:23Z","snapshot_observed_at":"2026-08-06T23:20:46.744749Z","submitted_at":"2025-06-22T16:52:48Z","title":"Deep Research Agents: A Systematic Examination And Roadmap","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:56.686867Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2506.18096"},"observation_digest":"sha256:1385d1dc6c5af75db8457d1fda08b138a5ec7f400ca4fe9c26140f707cc50ab1","observation_id":"a362af34-c1ab-407d-a5c7-509a9f7d5b3e","resolution":{"observed_at":"2026-08-06T23:26:56.686867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-06T23:20:33.163275Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning.arXiv preprint arXiv:2503.00223,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-08T14:41:10.472791Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.163275Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:dc545ef13e7cc5abdc7a2657b4c14d1f621dd29c7dca6b93f572dabf509dad5f","observation_id":"74867ca8-411d-4ef4-a9c4-a300bbb92cb6","resolution":{"observed_at":"2026-08-06T23:20:33.163275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-06T20:01:29.098275Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04069","last_updated":"2025-07-05T15:10:12Z","snapshot_observed_at":"2026-08-08T01:03:00.502856Z","submitted_at":"2025-07-05T15:10:12Z","title":"Beyond Independent Passages: Adaptive Passage Combination Retrieval for Retrieval Augmented Open-Domain Question Answering","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:01:29.098275Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2507.04069"},"observation_digest":"sha256:81e734cb9afcce9717fda1cde7fd40b6c69b00a2212541fced1b66debc697eec","observation_id":"26795ec2-f6b8-4c4a-aca3-55d9da057ccd","resolution":{"observed_at":"2026-08-06T20:01:29.098275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-06T17:49:48.879997Z","title":"arXiv preprint arXiv:2503.00223","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09884","last_updated":"2025-07-26T11:17:08Z","snapshot_observed_at":"2026-08-08T07:13:35.945934Z","submitted_at":"2025-07-14T03:45:24Z","title":"VerifyBench: A Systematic Benchmark for Evaluating Reasoning Verifiers Across Domains","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:49:48.879997Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2507.09884"},"observation_digest":"sha256:8ad162a477cc65322d6af933cacb69acaeedc2442df7a43422dc32e6f18379cc","observation_id":"7070c892-62b0-4f54-98b4-5e5e37f5b15e","resolution":{"observed_at":"2026-08-06T17:49:48.879997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":275,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:a6d6a876b214accb4cb2bbd22da18908be0b6cb46fa13312f9abbbc0cc70f7e5","observation_id":"7cf67020-c945-4a84-9d36-f214391e2de9","resolution":{"observed_at":"2026-05-18T19:21:46.705082Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-04T23:23:40.444325Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06650","last_updated":"2025-09-08T13:04:07Z","snapshot_observed_at":"2026-08-08T10:40:44.013249Z","submitted_at":"2025-09-08T13:04:07Z","title":"Domain-Aware RAG: MoL-Enhanced RL for Efficient Training and Scalable Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T23:23:40.444325Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2509.06650"},"observation_digest":"sha256:677635bffc06b427dc60da9d3f7427a7ca8ba45347051cb35c0b14e81fdbbf92","observation_id":"d2e0ec60-d36f-407e-9bd4-7b6ae20e19bb","resolution":{"observed_at":"2026-08-04T23:23:40.444325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-04T22:56:05.188630Z","title":"Jiang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-08-07T17:57:34.476487Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T22:56:05.188630Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2509.06949"},"observation_digest":"sha256:efbf9152b12ad1fc0da7682a9c3ab800d2c8a91f4d8b30d1b007c09dad3625b5","observation_id":"dee62877-ebc6-4646-bf44-2f95bb3a51bc","resolution":{"observed_at":"2026-08-04T22:56:05.188630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-04T09:08:01.942254Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.17139","last_updated":"2026-06-30T04:37:56Z","snapshot_observed_at":"2026-08-07T05:17:48.869163Z","submitted_at":"2025-10-20T04:16:28Z","title":"Rethinking On-policy Optimization for Query Augmentation","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T09:08:01.942254Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2510.17139"},"observation_digest":"sha256:57853600e892fe81567a34db3a0e0fa89f870e0bde5a02547746596c1ee6f24e","observation_id":"4cd9a041-d100-4fb8-81e6-9a0f83cb8368","resolution":{"observed_at":"2026-08-04T09:08:01.942254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2601.12538","last_updated":"2026-01-18T18:58:23Z","snapshot_observed_at":"2026-08-04T22:42:23.171653Z","submitted_at":"2026-01-18T18:58:23Z","title":"Agentic Reasoning for Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-17T15:14:25.558878Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2601.12538"},"observation_digest":"sha256:ab8d22f21a8caff47f2774ba50c8010d92a7d33441c406501ec0a73df4d9bc84","observation_id":"8101ce10-2b7b-4ad2-ad1d-c76b4a8d9052","resolution":{"observed_at":"2026-05-17T15:14:25.851932Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2601.21257","last_updated":"2026-04-19T21:04:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T04:36:52Z","title":"MoCo: A One-Stop Shop for Model Collaboration Research","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:37.129753Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2601.21257"},"observation_digest":"sha256:a941300b1dc368ab4261577901cd70a768359a89a6ca1518c523b69227ffbfc4","observation_id":"5cd8013a-c711-43b9-8815-4a4fe2f0de6c","resolution":{"observed_at":"2026-05-16T10:17:43.691021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2604.05818","last_updated":"2026-04-14T13:54:15Z","snapshot_observed_at":"2026-07-06T22:54:26.231593Z","submitted_at":"2026-04-07T12:52:38Z","title":"WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-10T19:59:10.657346Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2604.05818"},"observation_digest":"sha256:843ab4edaca5bc3fa5e9535381d51792e080ad22f49e4d9b54c3dec03a333d74","observation_id":"03f8cb0f-7b62-45c9-ae79-45eb3c5d24d0","resolution":{"observed_at":"2026-05-10T22:20:48.069237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2604.07201","last_updated":"2026-04-08T15:28:21Z","snapshot_observed_at":"2026-07-06T22:55:28.855291Z","submitted_at":"2026-04-08T15:28:21Z","title":"BRIDGE: Multimodal-to-Text Retrieval via Reinforcement-Learned Query Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T17:28:59.838565Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2604.07201"},"observation_digest":"sha256:2e863dc6068227441ba1353e09fa7e8cd4e35645fbe338f710d584e40d965e2a","observation_id":"05338bfd-0bef-4c4f-9d79-39314030f58b","resolution":{"observed_at":"2026-05-11T06:41:58.185271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2605.00505","last_updated":"2026-05-17T17:18:53Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T08:30:52Z","title":"LLM-Oriented Information Retrieval: A Denoising-First Perspective","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-09T18:54:06.144968Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2605.00505"},"observation_digest":"sha256:cefff94ccc5444e5ada69836be75db14fb6b09f4fe8018e74ccd296240f5ca3e","observation_id":"e46525f4-e212-48a2-b528-17297f55bcef","resolution":{"observed_at":"2026-05-11T16:01:19.410968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2605.00505","last_updated":"2026-05-17T17:18:53Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T08:30:52Z","title":"LLM-Oriented Information Retrieval: A Denoising-First Perspective","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-21T00:18:32.423103Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2605.00505"},"observation_digest":"sha256:84a554f65934b9999f9c760554aea70a196ac49d901797f919a796f203437d2e","observation_id":"16da76d2-a5d4-48d5-8b8b-3ef158b9fec5","resolution":{"observed_at":"2026-05-21T00:19:16.635713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2605.00560","last_updated":"2026-05-01T10:58:18Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T10:58:18Z","title":"When More Reformulations Hurt: Avoiding Drift using Ranker Feedback","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T18:40:35.840350Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2605.00560"},"observation_digest":"sha256:62f99138f329ea5a972ef752296aa18b6426d824c5a023d4988b2a9788ef18e7","observation_id":"a7ec09a6-cadd-477a-9e6e-4a2a4d894c5d","resolution":{"observed_at":"2026-05-09T19:35:39.582578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2605.26352","last_updated":"2026-08-06T01:35:38Z","snapshot_observed_at":"2026-08-08T17:15:37.726095Z","submitted_at":"2026-05-25T21:56:29Z","title":"RICE-PO: Turning Retrieval Interactions into Credit Signals for Reasoning Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T21:24:11.882268Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2605.26352"},"observation_digest":"sha256:11dddde0700dd0694f72cc7ae08d6e9530b41d083d4c92608d909ad77a74a32a","observation_id":"94781733-9bd7-401c-b1a7-b464f600e30c","resolution":{"observed_at":"2026-06-29T21:43:59.842264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-04T05:01:24.898991Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning.arXiv preprint arXiv:2503.00223, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26352","last_updated":"2026-08-06T01:35:38Z","snapshot_observed_at":"2026-08-08T17:15:37.726095Z","submitted_at":"2026-05-25T21:56:29Z","title":"RICE-PO: Turning Retrieval Interactions into Credit Signals for Reasoning Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T05:01:24.898991Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2605.26352"},"observation_digest":"sha256:0b8ed10dbf14623bcb6f1b135a20ff4642477010d9ebd377aa2d304c806fdb30","observation_id":"16c79743-9adf-4120-93e2-9c547587243c","resolution":{"observed_at":"2026-08-04T05:01:24.898991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-02T17:23:05.614302Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:07064ab677d386a4523a812a018ade6e5fa293109d83eb78ae6cec200564fddc","observation_id":"7dc89a95-3121-49e1-9d73-4dd2d5ec0194","resolution":{"observed_at":"2026-07-01T23:26:22.121774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2606.07299","last_updated":"2026-06-05T14:10:48Z","snapshot_observed_at":"2026-08-02T12:02:14.138415Z","submitted_at":"2026-06-05T14:10:48Z","title":"DuMate-DeepResearch: An Auditable Multi-Agent System with Recursive Search and Rubric-Grounded Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T22:04:37.766752Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2606.07299"},"observation_digest":"sha256:3df37edd35de9e04ac80df6d065eb1b12254463abcac303bfc1ee12fc50a5b0e","observation_id":"413b57ab-64db-4a4f-ba68-0b4b81f8cf15","resolution":{"observed_at":"2026-07-02T17:27:14.744673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2606.12191","last_updated":"2026-06-10T15:15:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T15:15:01Z","title":"Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application","version":1},"reference_index":293,"source":"pdf_text","source_observed_at":"2026-06-27T09:46:30.702256Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2606.12191"},"observation_digest":"sha256:59291f3a0661c062da1fe9d7cda863b35a4d84a3ca55d28b4f39778541129f04","observation_id":"8de0e9af-6faf-41e1-a121-afbe97e9c5cf","resolution":{"observed_at":"2026-06-27T09:50:48.456275Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2606.27733","last_updated":"2026-08-05T15:37:13Z","snapshot_observed_at":"2026-08-08T17:14:13.228421Z","submitted_at":"2026-06-26T05:29:08Z","title":"BashCoder-R1: Towards Robust and Explainable Bash Code Generation with Robustness-Aware Group Relative Policy Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T04:16:04.477464Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2606.27733"},"observation_digest":"sha256:6931afdb35818de580fa0af65ab04ec02ff97755312ae4009afe52414524bd26","observation_id":"77cd4fe3-a529-4362-ae5e-4be8937997a1","resolution":{"observed_at":"2026-07-01T17:05:50.881163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2606.28566","last_updated":"2026-06-26T19:44:34Z","snapshot_observed_at":"2026-08-02T14:59:42.646608Z","submitted_at":"2026-06-26T19:44:34Z","title":"R$^2$-Searcher: Calibrating Retrieval and Reasoning Boundaries for Agentic Search","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T00:33:59.778294Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2606.28566"},"observation_digest":"sha256:deb995488e01f3cd9b638d7d6fd00e14b607a25fb45dcb7c9f82d0a34052599d","observation_id":"36fbf8c0-1da7-4760-bb34-e4b8e2b4e1f5","resolution":{"observed_at":"2026-06-30T00:34:05.163437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-04T01:47:05.477346Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00030","last_updated":"2026-07-15T11:11:39Z","snapshot_observed_at":"2026-08-06T23:11:32.455260Z","submitted_at":"2026-07-15T11:11:39Z","title":"SLMs as Multi-Agent Routers: A Progressive SFT and Reinforcement Learning Approach","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T01:47:05.477346Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2608.00030"},"observation_digest":"sha256:af2dbfc565bd533c9addabf807b82423b774c49d3bcf584d2965102a2c40f542","observation_id":"2bdcbb89-4ab5-40b4-a29a-d9886aa44c2b","resolution":{"observed_at":"2026-08-04T01:47:05.477346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-04T07:50:50.618709Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02407","last_updated":"2026-08-03T15:49:14Z","snapshot_observed_at":"2026-08-07T11:36:44.216473Z","submitted_at":"2026-08-03T15:49:14Z","title":"Antares: Foundation Models for Agentic Vulnerability Localization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T07:50:50.618709Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2608.02407"},"observation_digest":"sha256:35e3aa9237bf81d9921e8ef8729bd877bf0a6e27f4b15cd2deee52ea3e922199","observation_id":"4ac43929-65a7-4c0b-a76d-0c1212d43599","resolution":{"observed_at":"2026-08-04T07:50:50.618709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-07T14:27:44.330205Z","title":"arXiv preprint arXiv:2503.00223 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06128","last_updated":"2026-08-06T15:01:29Z","snapshot_observed_at":"2026-08-08T17:19:47.481624Z","submitted_at":"2026-08-06T15:01:29Z","title":"Contextual Information Policy Optimization for Search Agents","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T14:27:44.330205Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2608.06128"},"observation_digest":"sha256:71aaa16c2d4148e7f631ca69fcdaec948cd9fe954ddc5521c9e7f027003c3107","observation_id":"668a14fe-e0cd-440c-8854-cb92036753e2","resolution":{"observed_at":"2026-08-07T14:27:44.330205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.00223/citation-record","integrity":"/paper/2503.00223/integrity","json":"/paper/2503.00223/citation-record.json","paper":"/paper/2503.00223"},"outbound":[],"paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","latest_version":3,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2503.00223."}