{"as_of":"2026-08-07T19:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5858fdc7984d89df1e75070a6173301ef38cdf74bdb5ed93b77b7d0f8d6047d","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:53:20.422106Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:38:36.016920Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T12:24:39.589042Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17391","snapshot_observed_at":"2026-08-07T05:38:36.016920Z","title":"Curriculum guided reinforcement learning for efficient multi hop retrieval augmented generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07411","last_updated":"2025-06-09T04:14:05Z","snapshot_observed_at":"2026-08-07T05:32:20.596021Z","submitted_at":"2025-06-09T04:14:05Z","title":"An Intelligent Fault Self-Healing Mechanism for Cloud AI Systems via Integration of Large Language Models and Deep Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:36.016920Z"},"links":{"cited_paper":"/paper/2505.17391","citing_paper":"/paper/2506.07411"},"observation_digest":"sha256:6927a901eb73796967f00e27fdbd1d26525bc4fa8d245bb57044b3df5a6fbff2","observation_id":"a8e4edd0-7322-4a71-aaed-5d0579545e48","resolution":{"observed_at":"2026-08-07T05:38:36.016920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17391","snapshot_observed_at":"2026-07-15T14:43:21.866055Z","title":"Curriculum guided reinforcement learning for efficient multi hop retrieval augmented generation.ArXiv, abs/2505.17391,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.05256","last_updated":"2026-07-02T16:41:10Z","snapshot_observed_at":"2026-08-06T04:07:42.199986Z","submitted_at":"2026-03-05T15:08:06Z","title":"Wiki-R1: Incentivizing Multimodal Reasoning for Knowledge-based VQA via Data and Sampling Curriculum","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-15T14:43:21.866055Z"},"links":{"cited_paper":"/paper/2505.17391","citing_paper":"/paper/2603.05256"},"observation_digest":"sha256:e4f9793c5f98cd63e74deb82d5f88868b3d896091b8279b99f7090c67d4eeffd","observation_id":"4a4d6b1b-9181-4a1b-968b-c05b004996ec","resolution":{"observed_at":"2026-07-15T14:43:21.866055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":"2505.17391","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17391","snapshot_observed_at":"2026-06-30T12:24:39.589042Z","title":"Curriculum Guided Reinforce- ment Learning for Efficient Multi-Hop Retrieval-Augmented Generation.arXiv preprint arXiv:2505.17391, 2025","venue":null,"work_id":"dcb04725-7d3b-414a-a3bd-e6b4c647744e","year":2025},"citing_paper":{"arxiv_id":"2605.24660","last_updated":"2026-06-07T02:58:55Z","snapshot_observed_at":"2026-08-06T13:09:07.919381Z","submitted_at":"2026-05-23T17:02:56Z","title":"How Many Tools Should an LLM Agent See? A Chance-Corrected Answer","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T12:22:59.494989Z"},"links":{"cited_paper":"/paper/2505.17391","citing_paper":"/paper/2605.24660"},"observation_digest":"sha256:aa98cc8136c7b7e7ddfc204227d23c816d31e9082bfcb61b93cebafcc1525637","observation_id":"e81a4a00-2486-416b-8351-ec8c56bdf6fc","resolution":{"observed_at":"2026-06-30T12:24:39.591834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17391/citation-record","integrity":"/paper/2505.17391/integrity","json":"/paper/2505.17391/citation-record.json","paper":"/paper/2505.17391"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:53:15.014802Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.014802Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:66fcb1e3d9f50cb7ad776b8cd971adeb15ab8cd90380eab8edb10effea9a6efc","observation_id":"84580aae-49ab-4e5b-a947-a36f7b326f54","resolution":{"observed_at":"2026-08-07T14:53:15.014802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:15.090620Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.090620Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:8fa84c8855ac9f583ec5f20c2395e436306a72cb97430bf586f9b8dc8f95dd53","observation_id":"b1223b34-7823-41f3-9505-7cec79c8b9c5","resolution":{"observed_at":"2026-08-07T14:53:15.090620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:15.172121Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.172121Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:8cc5357f6a1933b7c8160efad0705fb4ca8bf34777578387af973fb727379f0c","observation_id":"e647cb5a-7a64-4daf-bc19-238d22fe4de5","resolution":{"observed_at":"2026-08-07T14:53:15.172121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-07-06T17:25:35.493362Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-07T14:53:15.253176Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.253176Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:b4d2503a2b1aeaa9cfcbe4ea42ab91b629e4bfa70894d990d455588b7ce028f7","observation_id":"26b516a2-3f6b-4222-9979-2b8b18aa55dc","resolution":{"observed_at":"2026-08-07T14:53:15.253176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:15.393305Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.393305Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:c908a44bea71588a5854560167e6fbc06551aaf59ddbc670c40b0e5eb9386a1c","observation_id":"2f53c2f6-65b9-409d-9c69-2929e91a1d3a","resolution":{"observed_at":"2026-08-07T14:53:15.393305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:24.290706Z","title":null,"venue":null,"work_id":"f79dfe7f-da64-42db-bdcd-85e196f83217","year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.543549Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:3e692ea444252ccad7d941ef4fe45f8238c4f36b6fd158dbf1f0fa8149bab83d","observation_id":"8a01c430-ff6b-45bf-acb2-c3183f774fa7","resolution":{"observed_at":"2026-08-07T14:53:24.413542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:24.027246Z","title":null,"venue":null,"work_id":"5d5a0ff5-8f26-455e-9f03-322247c0356c","year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.635196Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:bf1fa0279768d017702e7920db76c595d119b4741cc5db3b82785a5c2f2d828f","observation_id":"039e2d18-1788-4aa4-9d59-4e44b603995d","resolution":{"observed_at":"2026-08-07T14:53:24.166387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18141","last_updated":"2025-03-10T09:49:31Z","snapshot_observed_at":"2026-07-06T19:38:39.889993Z","submitted_at":"2024-10-22T11:23:11Z","title":"SmartRAG: Jointly Learn RAG-Related Tasks From the Environment Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18141","snapshot_observed_at":"2026-08-07T14:53:15.758797Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.758797Z"},"links":{"cited_paper":"/paper/2410.18141","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:84989f075b97b4c2105d6447d3f45a213fe521840763e8c272459e6a8b4da8ec","observation_id":"abad9de6-3882-4b49-b5f0-0a9d21c71ad9","resolution":{"observed_at":"2026-08-07T14:53:15.758797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:53:15.856749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.856749Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:790034d70f70f99bf3001cd635faa157aaa36855db0ca53f7a4d6c0b1d757f41","observation_id":"295591a9-e185-4fcb-a654-41ee1d56cabb","resolution":{"observed_at":"2026-08-07T14:53:15.856749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.730283Z","title":null,"venue":null,"work_id":"8e8b38e3-ebd8-47f2-af8c-b9120d08f17d","year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.025551Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:7c0944582cf9c426b00370f95e45ef2e5149b0d06901084a8b8af3942515b4c2","observation_id":"377f636e-31ba-4bea-b552-724eefd9fc63","resolution":{"observed_at":"2026-08-07T14:53:23.880441Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12759","last_updated":"2025-05-23T21:59:14Z","snapshot_observed_at":"2026-08-03T13:09:39.767835Z","submitted_at":"2025-03-17T02:53:42Z","title":"RAG-RL: Advancing Retrieval-Augmented Generation via RL and Curriculum Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12759","snapshot_observed_at":"2026-08-07T14:53:16.182107Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.182107Z"},"links":{"cited_paper":"/paper/2503.12759","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:b80dd0bd8cd26fe96e9b4302ea6eaf429fe852443e9fd28afc594e6d635235ef","observation_id":"8ac2fce8-de6e-45e0-aa61-f358510b6fb4","resolution":{"observed_at":"2026-08-07T14:53:16.182107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15296","last_updated":"2025-04-16T04:00:04Z","snapshot_observed_at":"2026-08-07T16:01:57.497759Z","submitted_at":"2025-04-16T04:00:04Z","title":"Scalability Optimization in Cloud-Based AI Inference Services: Strategies for Real-Time Load Balancing and Automated Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15296","snapshot_observed_at":"2026-08-07T14:53:16.290988Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.290988Z"},"links":{"cited_paper":"/paper/2504.15296","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:998673562937a124308f66d03f05e4a08bd55345e3814b25428c6ed501702cc6","observation_id":"0479f63e-9310-4086-b9f7-8a97add8c1ac","resolution":{"observed_at":"2026-08-07T14:53:16.290988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12370","last_updated":"2025-03-19T05:38:58Z","snapshot_observed_at":"2026-07-06T20:08:12.033767Z","submitted_at":"2024-12-16T21:56:01Z","title":"Scam Detection for Ethereum Smart Contracts: Leveraging Graph Representation Learning for Secure Blockchain","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12370","snapshot_observed_at":"2026-08-07T14:53:16.343041Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.343041Z"},"links":{"cited_paper":"/paper/2412.12370","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:685a7c9fd77b7d723b39d4a21a0118bea1a8fa3e058244149494dda9f2c6fc7e","observation_id":"7a1fd43a-aebc-4bc6-a8a1-eca587d94a2c","resolution":{"observed_at":"2026-08-07T14:53:16.343041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22303","last_updated":"2025-04-15T08:10:39Z","snapshot_observed_at":"2026-08-07T16:30:36.751044Z","submitted_at":"2025-03-28T10:26:49Z","title":"Preference-based Learning with Retrieval Augmented Generation for Conversational Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.22303","snapshot_observed_at":"2026-08-07T14:53:16.422285Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.422285Z"},"links":{"cited_paper":"/paper/2503.22303","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:1ecbbfdcf7b827cac1f407e6be27f1f039a09aae8ae05907b9069c1aa0f0d055","observation_id":"6846f235-c473-4af6-a352-1509aebe99e4","resolution":{"observed_at":"2026-08-07T14:53:16.422285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:16.490441Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.490441Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:258b09f61a67c158aed35a4198565222222db23f4b47dc2625f66333d9621174","observation_id":"bb714cf5-580a-441b-a1c5-61ec151efa15","resolution":{"observed_at":"2026-08-07T14:53:16.490441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.527484Z","title":null,"venue":null,"work_id":"ad4c3706-7e01-4021-a26f-513df053c174","year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.568447Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:7141a8543e0408800b4bcff1c917cff3c9e398405a541230a932fac9909692ce","observation_id":"135b4c42-2b87-4f75-bd93-790c51a6da14","resolution":{"observed_at":"2026-08-07T14:53:23.593145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:16.815679Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.815679Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:7351186f684f3cf7a05296e9242cd5a86e1197149bdd6eca272ce5c85ead2a18","observation_id":"d6ec0ae4-69fc-4f73-82b3-45a5ce4624c4","resolution":{"observed_at":"2026-08-07T14:53:16.815679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17918","last_updated":"2025-01-11T15:26:48Z","snapshot_observed_at":"2026-07-06T18:37:00.469355Z","submitted_at":"2024-06-25T20:00:32Z","title":"GraphSnapShot: Caching Local Structure for Fast Graph Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17918","snapshot_observed_at":"2026-08-07T14:53:16.891893Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.891893Z"},"links":{"cited_paper":"/paper/2406.17918","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e13cacd978767f8b0c8454cd567540cac21b43654a751bf5a3e076f134151b2e","observation_id":"1a909371-337d-479f-bc02-2dcc140df3d2","resolution":{"observed_at":"2026-08-07T14:53:16.891893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18038","last_updated":"2025-05-01T03:27:16Z","snapshot_observed_at":"2026-07-06T18:37:04.753504Z","submitted_at":"2024-06-26T03:12:07Z","title":"MT2ST: Adaptive Multi-Task to Single-Task Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18038","snapshot_observed_at":"2026-08-07T14:53:17.031547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.031547Z"},"links":{"cited_paper":"/paper/2406.18038","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:8a1b7f330c7157a4ef2ce5813b00692a316e75ce992dd10f474ebf6654c720ab","observation_id":"55e628ee-cdee-4d60-ad0f-da3aec743336","resolution":{"observed_at":"2026-08-07T14:53:17.031547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10993","last_updated":"2025-02-16T04:56:53Z","snapshot_observed_at":"2026-08-07T18:15:11.727688Z","submitted_at":"2025-02-16T04:56:53Z","title":"RoseRAG: Robust Retrieval-augmented Generation with Small-scale LLMs via Margin-aware Preference Optimization","version":1},"cited_work":{"arxiv_id":"2502.10993","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.10993","snapshot_observed_at":"2026-08-07T14:53:21.088040Z","title":"RoseRAG: Robust Retrieval-augmented Generation with Small-scale LLMs via Margin-aware Preference Optimization","venue":"cs.CL","work_id":"425d03e5-ca2f-4380-9888-d20a06728e60","year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.147456Z"},"links":{"cited_paper":"/paper/2502.10993","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:85628f50cfd27155769d5c1d5625fd4ea838b41d9aef9c3646b66b8161b02be0","observation_id":"a4229d85-f16d-4e20-8480-db5eb1cdc559","resolution":{"observed_at":"2026-08-07T14:53:21.147377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:17.220200Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.220200Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:8f113f5da7869021f91cb8817319f9de062e52fbb6bfd1a4adee33cad4f2df45","observation_id":"533c38c7-6d3b-46c3-9564-95402c1fc9c3","resolution":{"observed_at":"2026-08-07T14:53:17.220200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03350","last_updated":"2023-10-17T18:57:17Z","snapshot_observed_at":"2026-07-31T15:52:06.089691Z","submitted_at":"2022-10-07T06:50:23Z","title":"Measuring and Narrowing the Compositionality Gap in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03350","snapshot_observed_at":"2026-08-07T14:53:17.278436Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.278436Z"},"links":{"cited_paper":"/paper/2210.03350","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:d2f60df7f0132555dca519b154881834fb3de584cb9a8763a8142f1f528732a9","observation_id":"2d613936-fc9a-410d-8334-e06e29eb841e","resolution":{"observed_at":"2026-08-07T14:53:17.278436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:17.384276Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.384276Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:ae5f05fa206483866f0c3802d8f230187bb56c010bf1631ea8890dbb0942689b","observation_id":"67a2c890-f157-47bd-ac7e-cc5c12c380fe","resolution":{"observed_at":"2026-08-07T14:53:17.384276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:17.488743Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.488743Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:f19d6b26f962e9ed933569b874373421a8a6c85d207ecc7d4ba0b2ec5611f2c1","observation_id":"a1ecbf84-b1e2-4cb1-81b1-380c9026e927","resolution":{"observed_at":"2026-08-07T14:53:17.488743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-07T14:53:17.564738Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.564738Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e3508a3d14f5f84d284f6521dc4665c022e49837a56c9434351bae573e30ecab","observation_id":"19d9e024-5b70-459c-b633-df906e7f27db","resolution":{"observed_at":"2026-08-07T14:53:17.564738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.334444Z","title":null,"venue":null,"work_id":"88a9a3d0-4a97-42a5-874e-1f3ee5327dee","year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.624194Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:d71ed1ee6608688ee1d53f5a92abd592c57be62e5ba5b0e95eb5f7741204b3e8","observation_id":"9c02533a-aa5b-4f7b-93b8-29465bc16538","resolution":{"observed_at":"2026-08-07T14:53:23.405410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:17.699345Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.699345Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:48dd3a5950ced9f3a49851ee244f56eec0b843c05e2464a615bfd9a3caa32537","observation_id":"18238a6f-699d-4013-90f6-bb9f89e00b9f","resolution":{"observed_at":"2026-08-07T14:53:17.699345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07861","last_updated":"2025-01-14T05:56:26Z","snapshot_observed_at":"2026-07-06T20:20:42.084970Z","submitted_at":"2025-01-14T05:56:26Z","title":"ReARTeR: Retrieval-Augmented Reasoning with Trustworthy Process Rewarding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07861","snapshot_observed_at":"2026-08-07T14:53:17.754749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.754749Z"},"links":{"cited_paper":"/paper/2501.07861","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:c4f6628c8ba9ff555de367c9a6b04a995aa9d74c332196786cdc4fc705db2ceb","observation_id":"321085c9-4f35-4d21-b713-e7e67745c6f4","resolution":{"observed_at":"2026-08-07T14:53:17.754749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:53:17.815854Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.815854Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:770477edd959d25be5efb3017a46be59b416cd0eb042a4ea9c08aadc127e27d4","observation_id":"c3e94cf6-26f0-4018-9b7a-e193db2db88c","resolution":{"observed_at":"2026-08-07T14:53:17.815854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:18.020784Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.020784Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:1785001d31ee16f2dcc3fdf06cb4bcb870120087c4b108503b69580f15f3158c","observation_id":"916d120d-5170-44e0-b4d0-780d5773d9de","resolution":{"observed_at":"2026-08-07T14:53:18.020784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18365","last_updated":"2025-01-30T14:15:09Z","snapshot_observed_at":"2026-08-01T00:39:41.224009Z","submitted_at":"2025-01-30T14:15:09Z","title":"RbFT: Robust Fine-tuning for Retrieval-Augmented Generation against Retrieval Defects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18365","snapshot_observed_at":"2026-08-07T14:53:18.188311Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.188311Z"},"links":{"cited_paper":"/paper/2501.18365","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:2df11c3d4ab350273f8c1216eb731f87b8eca0fc254a76dc815eb7c3fc5d9e32","observation_id":"d8a35478-b016-4a68-bffc-6a9a2bed20a5","resolution":{"observed_at":"2026-08-07T14:53:18.188311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:18.349674Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.349674Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:3a02a1e7e9c51440d6a6ada2deac5c5c1555ccc0f53e29450bccbeb2d1b264ff","observation_id":"55891a1b-3b3e-4c08-8665-50c3132f9d21","resolution":{"observed_at":"2026-08-07T14:53:18.349674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:18.092861Z","title":"Transactions of the Association for Computational Linguistics 10 (2022), 539–554","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.092861Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:50cd7aea8cf840615697aa5cc6e248629c70d684ff9337bb605bf0bd9c19bf97","observation_id":"47b15b4f-cd95-4ed2-b603-d83473942b8c","resolution":{"observed_at":"2026-08-07T14:53:18.092861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.167319Z","title":null,"venue":null,"work_id":"c1da1841-4ce6-4145-9ee4-4ef24dbc6c1b","year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.676820Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:886c221b3da94b73a99eeb65f3595cdcbf037354a2ecc7e14f9f23d32670a22f","observation_id":"77b6e025-60f0-4e87-b2be-bce3ce57ab30","resolution":{"observed_at":"2026-08-07T14:53:23.226286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13629","last_updated":"2025-03-02T00:46:31Z","snapshot_observed_at":"2026-08-07T06:20:11.846035Z","submitted_at":"2024-06-19T15:25:29Z","title":"InstructRAG: Instructing Retrieval-Augmented Generation via Self-Synthesized Rationales","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13629","snapshot_observed_at":"2026-08-07T14:53:18.922190Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.922190Z"},"links":{"cited_paper":"/paper/2406.13629","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:77df99ea93822b4ca356843a1bc7db85664883e824c283ca5b2904a0affdd58a","observation_id":"09d6b472-a2af-41c6-8f5f-444661a4041e","resolution":{"observed_at":"2026-08-07T14:53:18.922190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.023498Z","title":null,"venue":null,"work_id":"e0933387-838c-4ece-9f4a-00c4cab74fbe","year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.060260Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:477541e492cea790ec12413b31fd0a96a64ce557cc93c3f310ca0819533e2356","observation_id":"59bca393-3aa6-4da8-a815-a57238679064","resolution":{"observed_at":"2026-08-07T14:53:23.104104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.17072","last_updated":"2024-12-19T13:16:40Z","snapshot_observed_at":"2026-08-03T16:17:50.778068Z","submitted_at":"2024-08-30T07:57:30Z","title":"MaFeRw: Query Rewriting with Multi-Aspect Feedbacks for Retrieval-Augmented Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.17072","snapshot_observed_at":"2026-08-07T14:53:18.561534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.561534Z"},"links":{"cited_paper":"/paper/2408.17072","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:725fc428f5ad05ac65bafebf632fc0cee4806f3c2e74ce9bb58a4a994bf8b84f","observation_id":"edf635c5-338a-4c6e-a34b-d64d52fdeecc","resolution":{"observed_at":"2026-08-07T14:53:18.561534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T14:53:19.287940Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.287940Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:5f9486d96f68e869eaff11eea1c02b949ed489128ae3c03e0f17a97d0c6dd9da","observation_id":"fc66a19d-d994-4fd1-a13a-76c91ce23c71","resolution":{"observed_at":"2026-08-07T14:53:19.287940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08223","last_updated":"2025-02-27T19:03:36Z","snapshot_observed_at":"2026-08-07T01:31:03.238107Z","submitted_at":"2024-07-11T06:50:19Z","title":"Speculative RAG: Enhancing Retrieval Augmented Generation through Drafting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08223","snapshot_observed_at":"2026-08-07T14:53:18.791517Z","title":"arXiv preprint arXiv:2407.08223 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.791517Z"},"links":{"cited_paper":"/paper/2407.08223","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e116269c472e6fea41dab0ef71c6be34d5145d5c38b040c0533ab226f7c1a2ac","observation_id":"7e365823-f04e-4598-83f8-2022d759d626","resolution":{"observed_at":"2026-08-07T14:53:18.791517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-07-31T11:19:06.421362Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-07T14:53:19.533782Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.533782Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:52e132c973536a34db5bbc93ec584379bd6bc15431f4cf77e41cd0862e45a167","observation_id":"7993c6d0-7706-4374-87a1-1ec31fa5a585","resolution":{"observed_at":"2026-08-07T14:53:19.533782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:19.646988Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.646988Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:525ca951fa3159644658f620fff75a1e277bfe3576236ec23e6f4a908814ac45","observation_id":"a9917a52-7009-40f8-bcc1-74544ed0b1f2","resolution":{"observed_at":"2026-08-07T14:53:19.646988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13957","last_updated":"2026-05-16T17:37:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:56:03Z","title":"Supervising the search process produces reliable and generalizable information-seeking agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13957","snapshot_observed_at":"2026-08-07T14:53:19.152641Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.152641Z"},"links":{"cited_paper":"/paper/2502.13957","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:2c8b66b5cb987c39ca1da0d130780f6de02e4afcc62aab48bff4b2bc4589f6e4","observation_id":"4f8dcb8a-9872-4386-a866-3707322b1578","resolution":{"observed_at":"2026-08-07T14:53:19.152641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06206","last_updated":"2025-04-07T19:47:16Z","snapshot_observed_at":"2026-07-06T20:03:38.451641Z","submitted_at":"2024-12-09T04:56:43Z","title":"SiReRAG: Indexing Similar and Related Information for Multihop Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06206","snapshot_observed_at":"2026-08-07T14:53:19.868182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.868182Z"},"links":{"cited_paper":"/paper/2412.06206","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e19ace9035812358dc1c7d05c60352fd3e427206767e472fb4d20aff2f5f73fe","observation_id":"add02dd8-6bea-44d8-8831-95acd5e49425","resolution":{"observed_at":"2026-08-07T14:53:19.868182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:19.433996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.433996Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:7a423c5fefc5f31bd10a57a2650f7b4da56177519763a241be803b632ea6ca02","observation_id":"8c7849ee-c241-4eef-ad19-189d83170679","resolution":{"observed_at":"2026-08-07T14:53:19.433996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16843","last_updated":"2024-10-22T09:25:21Z","snapshot_observed_at":"2026-08-06T18:37:45.949397Z","submitted_at":"2024-10-22T09:25:21Z","title":"Trustworthy Alignment of Retrieval-Augmented Large Language Models via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16843","snapshot_observed_at":"2026-08-07T14:53:20.072426Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.072426Z"},"links":{"cited_paper":"/paper/2410.16843","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:bc84d61e14f3f6ad16cb8d15d8f65adbe0c0f685ac496b1aa1d9020b3d63556f","observation_id":"4cf87c32-1641-4c6d-9c84-0255a143f85b","resolution":{"observed_at":"2026-08-07T14:53:20.072426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:22.348315Z","title":null,"venue":null,"work_id":"2a54cb03-3803-4c0a-8aec-049d82515663","year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.165657Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:aa1b078faed75c960b9b6f01cb5c63c3b9f9bdfb6729fb3e1039cb43b2697b80","observation_id":"61015e4b-c3d3-4b4c-9cea-7651771fca0c","resolution":{"observed_at":"2026-08-07T14:53:22.936418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:19.763502Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.763502Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:6cce231f938949ef162bd5a055b7788cabd628124b8cd5fea67e5c4dae9542fd","observation_id":"5ebd14fa-6b07-49f2-93f3-889bef9dd74c","resolution":{"observed_at":"2026-08-07T14:53:19.763502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14245","last_updated":"2025-05-28T01:19:26Z","snapshot_observed_at":"2026-08-07T18:03:04.162159Z","submitted_at":"2025-02-20T04:19:05Z","title":"Mitigating Lost-in-Retrieval Problems in Retrieval Augmented Multi-Hop Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14245","snapshot_observed_at":"2026-08-07T14:53:20.422106Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.422106Z"},"links":{"cited_paper":"/paper/2502.14245","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:5f10003a5912d8432c2905bd75f75de1a42086567b8821fdc9d3f39cb9cb3b4a","observation_id":"582ed733-6de2-4f9c-95fd-af9fafa867a1","resolution":{"observed_at":"2026-08-07T14:53:20.422106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21071","last_updated":"2025-04-29T15:25:34Z","snapshot_observed_at":"2026-08-07T15:58:10.434310Z","submitted_at":"2025-04-29T15:25:34Z","title":"Automated Parking Trajectory Generation Using Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21071","snapshot_observed_at":"2026-08-07T14:53:19.979203Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.979203Z"},"links":{"cited_paper":"/paper/2504.21071","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:80ff1d52664c17781767af49f590a65aecf575ee9a36f0cb6e4c04d43a3ae793","observation_id":"6a95b0a5-e141-4496-a45a-e2b024937985","resolution":{"observed_at":"2026-08-07T14:53:19.979203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:21.527124Z","title":null,"venue":null,"work_id":"80071cee-8488-4e4f-84ba-f28ae93b168d","year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.294213Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:9a730f54e7658c81ffa4f51432c8fa11dd2e82426587f544c6713cd964c30c4e","observation_id":"63bece88-7485-4821-a8f2-fd7e0a094ebe","resolution":{"observed_at":"2026-08-07T14:53:21.662213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:18.457966Z","title":"Advances in neural information processing systems 33 (2020), 5776–5788","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.457966Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:714d3874426b88851eab426fef0c4f0f41c850294cf20e3f7258ecc408855c2c","observation_id":"6c8bab39-76e5-4e2c-894e-d32d60b776b5","resolution":{"observed_at":"2026-08-07T14:53:18.457966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10509","last_updated":"2023-06-23T00:59:13Z","snapshot_observed_at":"2026-07-06T14:33:08.041820Z","submitted_at":"2022-12-20T18:26:34Z","title":"Interleaving Retrieval with Chain-of-Thought Reasoning for Knowledge-Intensive Multi-Step Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10509","snapshot_observed_at":"2026-08-07T14:53:17.953795Z","title":"arXiv preprint arXiv:2212.10509 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.953795Z"},"links":{"cited_paper":"/paper/2212.10509","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:ce4cba32f6f0bf1a52573b61d8aa441c0c61f462ecca90f83db62a583b4a9cb7","observation_id":"3243b1be-7d22-4a4e-842e-c6cb63247843","resolution":{"observed_at":"2026-08-07T14:53:17.953795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11585","last_updated":"2025-03-10T17:21:37Z","snapshot_observed_at":"2026-07-06T19:17:19.354772Z","submitted_at":"2024-09-17T22:20:26Z","title":"Advances in APPFL: A Comprehensive and Extensible Federated Learning Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11585","snapshot_observed_at":"2026-08-07T14:53:16.668640Z","title":"arXiv preprint arXiv:2409.11585 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.668640Z"},"links":{"cited_paper":"/paper/2409.11585","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:bded513dc9dac85337acc732d5f08c43c38f5c6207d7d507a0cb4f1696f9d166","observation_id":"9cb2b352-c193-4bf7-b119-c9ad04234e25","resolution":{"observed_at":"2026-08-07T14:53:16.668640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05339","last_updated":"2025-04-06T01:11:02Z","snapshot_observed_at":"2026-08-07T16:08:18.522878Z","submitted_at":"2025-04-06T01:11:02Z","title":"Optimized Path Planning for Logistics Robots Using Ant Colony Algorithm under Multiple Constraints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05339","snapshot_observed_at":"2026-08-07T14:53:20.358295Z","title":"arXiv preprint arXiv:2504.05339 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.358295Z"},"links":{"cited_paper":"/paper/2504.05339","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:b82dc70270a0a5c07818bea3d2f68d62b34ea18b9445bd5deb2b3b88299fbcac","observation_id":"c0450736-3660-444e-9301-faa1ea828c0b","resolution":{"observed_at":"2026-08-07T14:53:20.358295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:45:46.054518Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 3 inbound Pith citation observations for arXiv:2505.17391."}