{"as_of":"2026-08-07T18:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9cc3192195aae1762e2d968dcf1043f4551e10a19e2de6cc488370142492eb1","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:20:35.039153Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18670/citation-record","integrity":"/paper/2506.18670/integrity","json":"/paper/2506.18670/citation-record.json","paper":"/paper/2506.18670"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.599529Z","title":"Umass at trec 2004: Novelty and hard","venue":null,"work_id":"74d02112-6c8e-4c78-9f2f-266a350312b1","year":2004},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.605177Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:a74727086b966240d201bfb463d7ab7d9fc6189881d976c11369274b0daf2e5f","observation_id":"79fa8d19-cdb3-4c89-9a72-22901181c182","resolution":{"observed_at":"2026-08-06T23:20:37.691985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.423259Z","title":"The snowflake elastic data warehouse","venue":null,"work_id":"1e8df78e-401d-4d2a-8890-5c23ebb85871","year":2016},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.719082Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:7a7e86072e216177eddb359430f9caa8e4d5a3c39de219ce869abf2f62e5528f","observation_id":"4e1cdd66-c5b3-4ea9-b701-efbbb5f65af7","resolution":{"observed_at":"2026-08-06T23:20:37.524777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.231316Z","title":"Dense passage retrieval for open-domain question answering","venue":null,"work_id":"8cf63423-848f-4fe6-9b50-f6dc3bfd0d6f","year":2020},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.240921Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:793a344840a71c7e93ccc210d6c35aca13251e96bb026f834d9a316fb99d0d4f","observation_id":"20186bc2-508f-4606-b4c1-13dd498c8fd2","resolution":{"observed_at":"2026-08-06T23:20:37.325696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14024","last_updated":"2023-01-23T17:00:01Z","snapshot_observed_at":"2026-08-06T22:47:15.172350Z","submitted_at":"2022-12-28T18:52:44Z","title":"Demonstrate-Search-Predict: Composing retrieval and language models for knowledge-intensive NLP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14024","snapshot_observed_at":"2026-08-06T23:20:33.318382Z","title":"Woosuk Kwon, Zhuohan Li, Siyuan Zhuang, Ying Sheng, Lianmin Zheng, Cody Hao Yu, Joseph E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.318382Z"},"links":{"cited_paper":"/paper/2212.14024","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:c40c13add310f11e10a9d72a21477eab5f5d7337374a657c15bdfaca776ae93f","observation_id":"b23ba221-dd4a-4a6a-8638-3338fc4540eb","resolution":{"observed_at":"2026-08-06T23:20:33.318382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.05115","last_updated":"2022-05-23T16:41:08Z","snapshot_observed_at":"2026-08-07T01:30:18.016560Z","submitted_at":"2022-03-10T02:24:14Z","title":"Internet-augmented language models through few-shot prompting for open-domain question answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05115","snapshot_observed_at":"2026-08-06T23:20:33.395421Z","title":"Internet- augmented language models through few-shot prompting for open-domain question answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.395421Z"},"links":{"cited_paper":"/paper/2203.05115","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:58a40de965d7c4901c63b00439c57c3ae1f34ac7d9316f74ec526ede394d282f","observation_id":"7538546d-82ba-4388-8348-3d50c4e685e2","resolution":{"observed_at":"2026-08-06T23:20:33.395421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.715421Z","title":"Query rewriting in retrieval- augmented large language models","venue":null,"work_id":"7bab6e98-5b88-4696-9ee4-60ce528160b3","year":2023},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.504793Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:5a81c298e8e06f2a0747581169287d61923ceaade854515aabddfd848c8163a7","observation_id":"e65e2d00-a61d-4f3e-833f-10908d9bc588","resolution":{"observed_at":"2026-08-06T23:20:36.834810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14431","last_updated":"2024-05-23T11:00:19Z","snapshot_observed_at":"2026-07-06T18:18:30.066741Z","submitted_at":"2024-05-23T11:00:19Z","title":"RaFe: Ranking Feedback Improves Query Rewriting for RAG","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14431","snapshot_observed_at":"2026-08-06T23:20:33.552216Z","title":"Rafe: ranking feedback improves query rewriting for rag.arXiv preprint arXiv:2405.14431,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.552216Z"},"links":{"cited_paper":"/paper/2405.14431","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:529aea5ce1c5fd80a8fb0746efd94bc6df6e626595a34cb20d5ba1765fd00e5b","observation_id":"05151d47-7f33-407c-abc0-81e1de0a52c3","resolution":{"observed_at":"2026-08-06T23:20:33.552216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03350","last_updated":"2023-10-17T18:57:17Z","snapshot_observed_at":"2026-07-31T15:52:06.089691Z","submitted_at":"2022-10-07T06:50:23Z","title":"Measuring and Narrowing the Compositionality Gap in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03350","snapshot_observed_at":"2026-08-06T23:20:33.669571Z","title":"Ofir Press, Muru Zhang, Sewon Min, Ludwig Schmidt, Noah A Smith, and Mike Lewis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.669571Z"},"links":{"cited_paper":"/paper/2210.03350","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:40fcb4b43e895e7405cda4ed70fca3303c3b9d104cf8baed21b5f14d681b3265","observation_id":"87fe10bd-61ec-4bea-a7b7-0679ec8b0b70","resolution":{"observed_at":"2026-08-06T23:20:33.669571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14233","last_updated":"2023-08-02T02:06:28Z","snapshot_observed_at":"2026-07-06T15:20:49.723743Z","submitted_at":"2023-04-27T14:45:55Z","title":"Large Language Models are Strong Zero-Shot Retriever","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14233","snapshot_observed_at":"2026-08-06T23:20:33.901661Z","title":"Large language models are strong zero-shot retriever.arXiv preprint arXiv:2304.14233,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.901661Z"},"links":{"cited_paper":"/paper/2304.14233","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:32a07015d538fd4e33bd14e1defdb8d739acf8b2531b5feecda8ef42f075b5ab","observation_id":"0d73d76e-2742-4d23-967f-7d90ae614c00","resolution":{"observed_at":"2026-08-06T23:20:33.901661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-06T23:20:33.950971Z","title":"Hybridflow: A flexible and efficient rlhf framework.arXiv preprint arXiv: 2409.19256,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.950971Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:43065737c06dc81212cf98b4afae3088d534a7ac49af04a3310b95d5e715ff5d","observation_id":"4d5aacc5-daf4-4d1a-8017-b0d10ac2db09","resolution":{"observed_at":"2026-08-06T23:20:33.950971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12652","last_updated":"2023-05-24T05:08:07Z","snapshot_observed_at":"2026-08-02T02:08:12.414817Z","submitted_at":"2023-01-30T04:18:09Z","title":"REPLUG: Retrieval-Augmented Black-Box Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12652","snapshot_observed_at":"2026-08-06T23:20:34.022956Z","title":"Replug: Retrieval-augmented black-box language models.arXiv preprint arXiv:2301.12652,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.022956Z"},"links":{"cited_paper":"/paper/2301.12652","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:3de21399f2488f0157471d03279dc046e3e7a2160f37d457d6c39ae23ba7cb5b","observation_id":"ab97999b-f31d-4919-a89e-6b1423ec8dcc","resolution":{"observed_at":"2026-08-06T23:20:34.022956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07678","last_updated":"2023-10-11T08:34:42Z","snapshot_observed_at":"2026-07-06T15:03:00.555225Z","submitted_at":"2023-03-14T07:27:30Z","title":"Query2doc: Query Expansion with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.07678","snapshot_observed_at":"2026-08-06T23:20:34.396029Z","title":"Query2doc: Query expansion with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.396029Z"},"links":{"cited_paper":"/paper/2303.07678","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:99f817ba205b43e8ae4e4b72b063e4ad92467f66a9bcbd932b03e03cd3c44e17","observation_id":"972397bb-0e2d-4add-b463-bb80b7c22ca2","resolution":{"observed_at":"2026-08-06T23:20:34.396029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05672","last_updated":"2024-02-08T13:47:50Z","snapshot_observed_at":"2026-07-30T09:46:51.062184Z","submitted_at":"2024-02-08T13:47:50Z","title":"Multilingual E5 Text Embeddings: A Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05672","snapshot_observed_at":"2026-08-06T23:20:34.478229Z","title":"Multilin- gual e5 text embeddings: A technical report.arXiv preprint arXiv:2402.05672,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.478229Z"},"links":{"cited_paper":"/paper/2402.05672","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:fc38fe37c014ca4ee8e6ef8dfde42dd465b15697193ae896e91036baf6b88531","observation_id":"4b4b9822-f99f-4585-801e-c208140af0ec","resolution":{"observed_at":"2026-08-06T23:20:34.478229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.174774Z","title":"Query expansion with freebase.Proceedings of the 2015 International Conference on The Theory of Information Retrieval,","venue":null,"work_id":"c4ce2833-76ee-4758-a1de-e69844f20a92","year":2015},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.616862Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:6c496d22b0b8bc506d34274fdc36b07aefb3194b07a6485aca214e96000e9dfe","observation_id":"8acf5575-aed1-41f6-b98e-495124b08d58","resolution":{"observed_at":"2026-08-06T23:20:36.290421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09716","last_updated":"2023-10-18T13:48:03Z","snapshot_observed_at":"2026-08-03T14:45:57.019068Z","submitted_at":"2023-10-15T03:04:17Z","title":"Enhancing Conversational Search: Large Language Model-Aided Informative Query Rewriting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09716","snapshot_observed_at":"2026-08-06T23:20:34.734211Z","title":"Enhancing conversational search: Large language model-aided informative query rewriting.arXiv preprint arXiv:2310.09716,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.734211Z"},"links":{"cited_paper":"/paper/2310.09716","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:ae510f06b2fff35950713d16289b0e7224ebbd46a97eccd31c1af242a14cfa53","observation_id":"55e68d54-7f8a-4167-bb2e-bed4084c9bad","resolution":{"observed_at":"2026-08-06T23:20:34.734211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.767833Z","title":"The best results are bolded, and other top-three results are underlined","venue":null,"work_id":"6551a17e-2975-4fa4-9267-a7f1c3a0329e","year":2018},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.925176Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:e54ac878ab771243e277dcd5c720d0ca41b7734fd9b5501c7554b82b42532f49","observation_id":"85f834c6-fc70-45e6-8e58-6505313c2126","resolution":{"observed_at":"2026-08-06T23:20:35.862890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.489201Z","title":null,"venue":null,"work_id":"d6eb561a-cc3a-46b3-b82b-269fa29507a9","year":2025},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:35.039153Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:b4d739311fcd171e3350d93096d0c510293c0f55a0ab81c0b7287e91c7a6e1e2","observation_id":"ac510c28-a231-4374-afb1-860b06c7d40e","resolution":{"observed_at":"2026-08-06T23:20:35.572703Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:32.637146Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":1982,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.637146Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:c774b7f7c30a410c9028cc7cd1536733df5b54759323d7ce31a42dcb3f101ba1","observation_id":"b94e965a-0b18-4840-a46d-89f518f9e607","resolution":{"observed_at":"2026-08-06T23:20:32.637146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:20:33.836645Z","title":"Proximal policy optimization algorithms.ArXiv, abs/1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":1988,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.836645Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:c6748612c5ecd7537bb8957d4f564719243e903d5bbb0afa2b449595ab72ae70","observation_id":"6a151714-9eed-4091-a757-208583949cb7","resolution":{"observed_at":"2026-08-06T23:20:33.836645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-06T19:18:51.065158Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-06T23:20:34.126560Z","title":"Ziegler, Ryan J","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.126560Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:0e7139db9a1ad59c841ad56074622cdf85cde8a000b2ee2482c5ee930f6df3ac","observation_id":"485abd80-0eaa-4066-918c-5f70f1482e8f","resolution":{"observed_at":"2026-08-06T23:20:34.126560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14924","last_updated":"2024-09-23T11:20:20Z","snapshot_observed_at":"2026-07-06T19:20:23.589464Z","submitted_at":"2024-09-23T11:20:20Z","title":"Retrieval Augmented Generation (RAG) and Beyond: A Comprehensive Survey on How to Make your LLMs use External Data More Wisely","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14924","snapshot_observed_at":"2026-08-06T23:20:34.827663Z","title":"Siyun Zhao, Yuqing Yang, Zilong Wang, Zhiyuan He, Luna K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.827663Z"},"links":{"cited_paper":"/paper/2409.14924","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:fe5a4bc5f57c022572b8f4986808a1ffac3af280d6c4fe61faa3493779506699","observation_id":"48056f53-88b4-4252-9b74-57141a8c9a6a","resolution":{"observed_at":"2026-08-06T23:20:34.827663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.460026Z","title":"Hamilton, Chris Dyer, and Dani Yogatama","venue":null,"work_id":"0bb920b8-8382-4ae5-86ee-d6df115ce494","year":2021},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.770375Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:6df06ac3dc856657d5cbc231e4015c5e55200d197e2c3c75592a8ad15b8ce004","observation_id":"9a58daef-afd3-4083-806f-55bfefd012a9","resolution":{"observed_at":"2026-08-06T23:20:36.544748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08663","last_updated":"2021-10-21T01:18:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-04-17T23:29:55Z","title":"BEIR: A Heterogenous Benchmark for Zero-shot Evaluation of Information Retrieval Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08663","snapshot_observed_at":"2026-08-06T23:20:34.235230Z","title":"Beir: A heterogenous benchmark for zero-shot evaluation of information retrieval models.arXiv preprint arXiv:2104.08663,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.235230Z"},"links":{"cited_paper":"/paper/2104.08663","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:293082475886c963d3fa944e3130588a2b1c204997dd4ca8f08dcbc685443cab","observation_id":"018011c7-66aa-410b-97a7-4c2ebbe1bb2c","resolution":{"observed_at":"2026-08-06T23:20:34.235230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08281","last_updated":"2025-10-23T09:36:08Z","snapshot_observed_at":"2026-07-31T05:45:37.385210Z","submitted_at":"2024-01-16T11:12:36Z","title":"The Faiss library","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08281","snapshot_observed_at":"2026-08-06T23:20:32.777818Z","title":"The faiss library.arXiv preprint arXiv:2401.08281,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.777818Z"},"links":{"cited_paper":"/paper/2401.08281","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:74da42ef71860980f6225dcde75aff9bbe4d1675939d45d074ba59926190e1c8","observation_id":"dec8fa1e-815e-4e34-af85-c3f40b074e0d","resolution":{"observed_at":"2026-08-06T23:20:32.777818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-03T14:31:51.401500Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-06T23:20:32.682670Z","title":"Brown, Miljan Martic, Shane Legg, and Dario Amodei","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.682670Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:72b37f007060ef0b36990e6e005e6eff073898c835489560ef4499fda6b8efd9","observation_id":"af19faba-db54-47d0-b29d-51a38a178c0c","resolution":{"observed_at":"2026-08-06T23:20:32.682670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-06T23:20:33.608260Z","title":"Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, John Schulman, Jacob Hilton, Fraser Kelton, Luke E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.608260Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:c2376cce8961c00e5b0439f0a5aa8e04d7fb7e574cb23f7bc2c954660af6a0bd","observation_id":"4310ec17-a2b9-458f-8c47-416bd189990a","resolution":{"observed_at":"2026-08-06T23:20:33.608260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.936379Z","title":"You only need one model for open-domain question answering","venue":null,"work_id":"69976ced-7169-4880-b678-56f487381fb1","year":2022},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.444259Z"},"links":{"citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:c5f513d785d6e646f3cf6642bf435f2216261f6cfab3ee1462db7f88389b3ebc","observation_id":"5f5d099a-4029-4665-a511-63766b0cc725","resolution":{"observed_at":"2026-08-06T23:20:37.075468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23214","last_updated":"2024-10-31T01:34:16Z","snapshot_observed_at":"2026-08-04T22:48:50.229098Z","submitted_at":"2024-10-30T17:02:54Z","title":"Grounding by Trying: LLMs with Reinforcement Learning-Enhanced Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23214","snapshot_observed_at":"2026-08-06T23:20:32.987960Z","title":"Grounding by trying: Llms with reinforcement learning-enhanced retrieval.arXiv preprint arXiv:2410.23214,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.987960Z"},"links":{"cited_paper":"/paper/2410.23214","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:ae70d07488e0c7170c4dae6471fa77a5673983edd9c949aa3f1a62e0d6f4f319","observation_id":"5487c94a-887e-4904-a508-d404b5b6fd49","resolution":{"observed_at":"2026-08-06T23:20:32.987960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T23:20:34.331047Z","title":"Stone, Peter Albert, Amjad Almahairi, Yasmine Babaei, Nikolay Bashlykov, Soumya Batra, Prajjwal Bhargava, Shruti Bhosale, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:34.331047Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:d65b9706f10fe75d3df487783ad0fe1673a624a422ba1bbff19b1b2cb30d702c","observation_id":"c2d4a71f-ae04-4fdb-a072-61723c9d16ef","resolution":{"observed_at":"2026-08-06T23:20:34.331047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-06T23:20:33.163275Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning.arXiv preprint arXiv:2503.00223,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.163275Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:f8b0f20276305bfe393750268116b4ce246b756a942baab939d3d66516fd5a93","observation_id":"74867ca8-411d-4ef4-a9c4-a300bbb92cb6","resolution":{"observed_at":"2026-08-06T23:20:33.163275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:20:32.914472Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.914472Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:720a900bee8c238abdbecb4fcb92071d585d577109882373a07bf25f4fd1376a","observation_id":"a7b57add-abc9-42b3-b093-f1a095e911ca","resolution":{"observed_at":"2026-08-06T23:20:32.914472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-06T23:20:32.857634Z","title":"Retrieval-augmented generation for large language models: A survey.arXiv preprint arXiv:2312.10997, 2:1,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.857634Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:0ec2334a54a5640b473f46f84f05af4f0e26593634927d8a0d1321a820d01485","observation_id":"8b3849b0-f77e-42db-ad16-6dc09ccd52a0","resolution":{"observed_at":"2026-08-06T23:20:32.857634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-06T23:20:33.108723Z","title":"Reinforce++: A simple and efficient approach for aligning large language models.arXiv preprint arXiv:2501.03262,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:33.108723Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2506.18670"},"observation_digest":"sha256:872d0740dfc48b83f393d38edaa245d7638799af4777c1377bcf1835968ea169","observation_id":"b8150b4c-7826-4b4e-b19d-35af7d4f7ec9","resolution":{"observed_at":"2026-08-06T23:20:33.108723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18670","last_updated":"2025-06-23T14:14:43Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-06T23:13:30.465608Z","submitted_at":"2025-06-23T14:14:43Z","title":"Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2506.18670."}