{"as_of":"2026-08-06T02:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bfe76e18fc1396893358423ec662f35032998ae9b13c12b6fadbbe21ce15f79d","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T04:19:01.836535Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.10488/citation-record","integrity":"/paper/2605.10488/integrity","json":"/paper/2605.10488/citation-record.json","paper":"/paper/2605.10488"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.04153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neuro- symbolic entity alignment via variational inference.arXiv preprint arXiv:2410.04153","venue":null,"work_id":"c35aceb7-8bc8-4198-b922-877d07a71938","year":null},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:8304d6264f4c46f04c7e9094466385d1872669396c3576e05c756d75d0ec2155","observation_id":"48c5e544-52a6-4848-a0ae-64afa801d7f1","resolution":{"observed_at":"2026-05-12T06:26:23.519182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":"2504.19413","doi":"10.48550/arxiv.2504.19413","metadata_source":"pith","pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","venue":"cs.CL","work_id":"a5aed26c-a248-48b6-a59e-f7693fcb180a","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:cb0248d66a8fff2d74ab3f81be9f206f18f64d6737106c78f15669ab7d35adf2","observation_id":"5631b6dd-92a0-4b22-b394-1e783cdf536f","resolution":{"observed_at":"2026-05-12T06:26:23.540099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.16597","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distill-synthkg: Distilling knowledge graph synthesis workflow for improved coverage and efficiency.arXiv preprint arXiv:2410.16597","venue":null,"work_id":"728fcdef-083b-4feb-b492-1e7cb88a5e92","year":null},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:3bf0ea2804ddbb8841afea77fae5ec20c166b42c20fac01be0321ffdb22f8385","observation_id":"3cdd3d0c-ac01-4c78-915f-45141e91c19b","resolution":{"observed_at":"2026-05-12T06:26:23.585927Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3233/sw-160218","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Paulheim, Knowledge graph refinement: A survey of approaches and evaluation methods, Semantic Web 8 (3) (2017) 489–508","venue":"Semantic Web","work_id":"169754d4-9f1b-4c9e-9fe0-e1e80a3c5d00","year":2016},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:2094d70f6c6aaacb2b3d026527023f5c56764ce19aeb2f961c2c4d35499f96f4","observation_id":"6c233309-ab0b-443f-9d4c-7494e4e2ea01","resolution":{"observed_at":"2026-05-12T04:21:21.303909Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T09:52:50.439681+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T09:52:50.439681+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"cited_work":{"arxiv_id":"2404.16130","doi":"10.48550/arxiv.2404.16130","metadata_source":"pith","pith_arxiv_id":"2404.16130","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","venue":"cs.CL","work_id":"588618d7-fd41-4053-b34d-a981f8793039","year":2024},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2404.16130","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:4b65438e9cc38d28e53b887f54f295c74329a89387495c01101849ffa0a9e99d","observation_id":"8b4ac1e1-bea6-43e2-a6a0-9f3a9fc391bb","resolution":{"observed_at":"2026-05-12T06:26:23.480552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:57.694079+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:57.694079+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":"2312.10997","doi":"10.1186/1476-072x-8-72","metadata_source":"pith","pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","venue":"cs.CL","work_id":"b80d2790-6cd9-4c87-b3c4-de404f99a80e","year":2023},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:b711cb0f8d0c7c76e5eb5e126f3bfb999fbdf16a7e3ee605b9dfe2a299f5aa3c","observation_id":"ec25b426-07de-4822-b458-880d292665c1","resolution":{"observed_at":"2026-05-12T06:26:23.472029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05779","last_updated":"2025-04-28T17:36:27Z","snapshot_observed_at":"2026-07-31T06:48:41.810549Z","submitted_at":"2024-10-08T08:00:12Z","title":"LightRAG: Simple and Fast Retrieval-Augmented Generation","version":3},"cited_work":{"arxiv_id":"2410.05779","doi":"10.48550/arxiv.2410.05779","metadata_source":"pith","pith_arxiv_id":"2410.05779","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LightRAG: Simple and Fast Retrieval-Augmented Generation","venue":"cs.IR","work_id":"6118de04-b8eb-4163-826a-0f91a1bcdf14","year":2024},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2410.05779","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:8ed82cd976cd34527543dfaef9c7e16478400ca925ba3df22ad55b984e8c60a7","observation_id":"3f342ea3-4318-456c-90bc-d95602349674","resolution":{"observed_at":"2026-05-13T01:59:04.437407Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14802","last_updated":"2025-06-19T21:34:45Z","snapshot_observed_at":"2026-07-06T20:39:57.316580Z","submitted_at":"2025-02-20T18:26:02Z","title":"From RAG to Memory: Non-Parametric Continual Learning for Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.14802","doi":"10.48550/arxiv.2502.14802","metadata_source":"pith","pith_arxiv_id":"2502.14802","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From RAG to Memory: Non-Parametric Continual Learning for Large Language Models","venue":"cs.CL","work_id":"f768fbda-cd1e-4a8e-b67c-040f4242fe93","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2502.14802","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:5a4315aed60374984a7936ad3def50f5524e7578d9e78bf229b534c79c22037d","observation_id":"3f17e555-49ea-4829-b917-da58214c3f44","resolution":{"observed_at":"2026-05-17T01:36:19.859440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24290","last_updated":"2025-07-05T09:01:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-31T16:36:05Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","version":2},"cited_work":{"arxiv_id":"2503.24290","doi":"10.48550/arxiv.2503.24290","metadata_source":"pith","pith_arxiv_id":"2503.24290","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","venue":"cs.LG","work_id":"763e0e44-40dd-4bdd-8414-21f8f9ce6d10","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2503.24290","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:32d62e64220ab62db6872e22a722d2a7fff8d61286cabe4a35aa04f2dfe9fe68","observation_id":"a7b5669d-13a9-4740-9d0c-d45d7ce0ba2f","resolution":{"observed_at":"2026-05-12T21:59:02.400889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.10150","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:28:55.964780Z","title":"Retrieval-augmented generation with hierarchical knowledge.arXiv preprint arXiv:2503.10150","venue":null,"work_id":"2fdfa77e-2fe1-4db6-a584-056c64ead83c","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:d9e7831107fdc4ea668403c649721c19b5e79d8c4a1f13129dbf17eecec23b1f","observation_id":"3bbce0a4-7f4a-431c-b155-1c8c65171ea0","resolution":{"observed_at":"2026-05-12T06:26:23.453207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:366b041cedd77c13a56fe7ad8aac1a93b7f125e20348e9efcd3cf7cf3816ebf8","observation_id":"0ba73384-b61d-4e3a-9b40-17255fd5a62f","resolution":{"observed_at":"2026-05-12T06:26:23.406074Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"s3: You don’t need that much data to train a search agent via rl","venue":null,"work_id":"f3dfce2f-6a4b-461b-9271-f71b44ee8bd8","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:b2511e8bc96a4fed1941c48c705fabdfe8a7efb72e77040ddd178fcf00c39a6f","observation_id":"51c49942-a680-4cf0-8aad-d049bbe02e1e","resolution":{"observed_at":"2026-05-12T15:41:40.143193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2503.09516","doi":"10.48550/arxiv.2503.09516","metadata_source":"pith","pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","venue":"cs.CL","work_id":"0e0b7549-2bc4-4574-aa7f-588ffa16eaae","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:41d3ba60835340e8106a744f5977ff269890a244b83b3ab34c98938812996303","observation_id":"922d26e3-d591-4e33-8e19-041dfc1d5cbb","resolution":{"observed_at":"2026-05-12T06:26:23.580444Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:9fee3f49545365c7b5fdfe9871a119e16b074bed445e426f4fbc072ffcb1f043","observation_id":"47ce6274-086d-4dd1-8dbc-0fe4aa7cc187","resolution":{"observed_at":"2026-05-12T06:26:23.533910Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":"2503.20783","doi":"10.48550/arxiv.2503.20783","metadata_source":"pith","pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","venue":"cs.LG","work_id":"ec354f3b-9484-4a0c-94c8-92d4d0260835","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:e8b490dd066c797b8e86f87148ab4cf5ea9a62559a45885beab2785a51656dc7","observation_id":"57ab5716-4ed3-4a69-b202-bf5905c40190","resolution":{"observed_at":"2026-05-12T06:26:23.439454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21892","last_updated":"2026-06-02T20:20:31Z","snapshot_observed_at":"2026-08-02T05:13:58.893429Z","submitted_at":"2025-07-29T15:01:26Z","title":"Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2507.21892","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21892","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph-r1: Towards agentic graphrag framework via end-to- end reinforcement learning.arXiv preprint arXiv:2507.21892","venue":null,"work_id":"6d294079-b9c1-4d71-bc29-485a3a606824","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2507.21892","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:7bc4665679bcf5e1fde797710361102cd8e6bb70d2bef44bf5473dc9f7836ff2","observation_id":"09f130b6-8182-4d7f-a0f8-583bb253d92a","resolution":{"observed_at":"2026-06-04T02:06:52.238547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05740","last_updated":"2021-04-12T18:10:39Z","snapshot_observed_at":"2026-08-05T19:01:52.695038Z","submitted_at":"2021-04-12T18:10:39Z","title":"A Replication Study of Dense Passage Retriever","version":1},"cited_work":{"arxiv_id":"2104.05740","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.05740","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A replication study of dense passage retriever.arXiv preprint arXiv:2104.05740","venue":null,"work_id":"530bf423-4994-4392-88dc-210d54aad0f3","year":2021},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2104.05740","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:54c0873bdcb742337a4b8c7f5be948ed46f675c6b47605c301f10b3571708310","observation_id":"43133230-671d-4818-afaf-78bce3287679","resolution":{"observed_at":"2026-05-12T06:26:23.412406Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17753","last_updated":"2024-02-27T18:42:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T18:42:31Z","title":"Evaluating Very Long-Term Conversational Memory of LLM Agents","version":1},"cited_work":{"arxiv_id":"2402.17753","doi":"10.18653/v1/2024.acl-long.747arxiv:2402.17753","metadata_source":"pith","pith_arxiv_id":"2402.17753","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Evaluating Very Long-Term Conversational Memory of LLM Agents","venue":"cs.CL","work_id":"2d8c9fb7-9ace-4925-8fe1-f4e44625d04c","year":2024},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2402.17753","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:da40fda9e9e0205b5207f0a1ac2d43879bb7bd35022f6caa86c49957e73280c5","observation_id":"93979751-ce2e-4b5f-96eb-00a8d1d376c5","resolution":{"observed_at":"2026-05-12T08:05:17.171076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13956","last_updated":"2025-01-20T16:52:48Z","snapshot_observed_at":"2026-07-29T15:53:45.545304Z","submitted_at":"2025-01-20T16:52:48Z","title":"Zep: A Temporal Knowledge Graph Architecture for Agent Memory","version":1},"cited_work":{"arxiv_id":"2501.13956","doi":"10.48550/arxiv.2501.13956","metadata_source":"pith","pith_arxiv_id":"2501.13956","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zep: A Temporal Knowledge Graph Architecture for Agent Memory","venue":"cs.CL","work_id":"515c933e-12ae-439d-a7ff-c07fee482dfb","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2501.13956","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:4ee7a5e8486fc9bc83670522873f1ffded58d064dcb3603700b5dade128a08f8","observation_id":"f4177b31-5447-4dc5-a0e1-c84e4ed46f78","resolution":{"observed_at":"2026-05-12T06:26:23.559902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:bb2ed7ebc3cf26503cf3c5e01d7153e26704a66ec65758a364bd8272eedc6d85","observation_id":"d69d2517-5c34-468c-9e65-114e88a9e687","resolution":{"observed_at":"2026-05-12T06:26:23.596552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:68e6d47fb4a4d7ddcf929e4eb153c004d94827c14607b091e4bd4f58e0994ed6","observation_id":"93634d9a-6929-42e9-ada6-ece57d5a629e","resolution":{"observed_at":"2026-05-12T06:26:23.613344Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.15339","last_updated":"2026-04-20T12:40:35Z","snapshot_observed_at":"2026-07-06T22:32:57.286856Z","submitted_at":"2025-10-17T06:03:36Z","title":"AutoGraph-R1: End-to-End Reinforcement Learning for Knowledge Graph Construction","version":3},"cited_work":{"arxiv_id":"2510.15339","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.15339","snapshot_observed_at":"2026-06-28T20:42:37.993588Z","title":"AutoGraph-R1: End-to-End Reinforcement Learning for Knowledge Graph Construction","venue":"cs.CL","work_id":"4604f8e8-da59-41d7-8fb1-c3ce2c9ea230","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2510.15339","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:7756fbabfb9efd77f7b76e69b92140d97ca326eab07a19585e9a9cee641a3c3e","observation_id":"784aedad-9fc7-4402-91ae-c52153fc49fc","resolution":{"observed_at":"2026-05-12T06:26:23.528480Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25911","last_updated":"2025-09-30T08:02:34Z","snapshot_observed_at":"2026-07-06T22:31:15.349221Z","submitted_at":"2025-09-30T08:02:34Z","title":"Mem-{\\alpha}: Learning Memory Construction via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2509.25911","doi":"10.48550/arxiv.2509.25911","metadata_source":"pith","pith_arxiv_id":"2509.25911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mem-{\\alpha}: Learning Memory Construction via Reinforcement Learning","venue":"cs.CL","work_id":"4643330b-80ff-49a5-bbb1-e618edaffe35","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2509.25911","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:18484a63d45465bceb67f5b045beb96b26d0aa089a47680066b53827f792a44e","observation_id":"e75c105c-db02-4b37-b433-c744e619cbdb","resolution":{"observed_at":"2026-05-16T17:19:44.839865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:50:53.619604+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:50:53.619604+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07978","last_updated":"2026-07-13T12:55:23Z","snapshot_observed_at":"2026-08-03T11:01:42.993651Z","submitted_at":"2026-01-12T20:20:35Z","title":"Cost and Accuracy of Long-Term Memory in Distributed Multi-Agent Systems Based on Large Language Models","version":4},"cited_work":{"arxiv_id":"2601.07978","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.07978","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sikuan Yan, Xiufeng Yang, Zuchao Huang, Ercong Nie, Zifeng Ding, Zonggen Li, Xiaowen Ma, Hinrich Sch¨utze, Volker Tresp, and Yunpu Ma","venue":null,"work_id":"915a979a-9b93-413e-807f-6073b0c4b763","year":null},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2601.07978","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:fd84cf01039434e4c06e266919f41bb2699f9355eabd450d64990ea04e84c0b7","observation_id":"66d14bd2-776c-4f9c-bf5e-11000f273f42","resolution":{"observed_at":"2026-06-02T02:03:37.535466Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05668","last_updated":"2025-08-19T05:15:19Z","snapshot_observed_at":"2026-07-06T22:09:33.606473Z","submitted_at":"2025-08-03T08:02:51Z","title":"A Survey of LLM-based Deep Search Agents: Paradigm, Optimization, Evaluation, and Challenges","version":3},"cited_work":{"arxiv_id":"2508.05668","doi":"10.48550/arxiv.2508.05668","metadata_source":"pith","pith_arxiv_id":"2508.05668","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2508.05668 , year=","venue":"cs.IR","work_id":"d504829e-614b-4812-bb38-8ee43f2a863f","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2508.05668","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:ca731ae9c3ce23bf7e371cf630c31338454391db97313a737106a687a90e0021","observation_id":"a91df4ae-4735-48a0-a27d-6d0410558fc8","resolution":{"observed_at":"2026-05-12T06:26:23.574460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19828","last_updated":"2026-01-14T14:21:21Z","snapshot_observed_at":"2026-07-06T22:19:28.487854Z","submitted_at":"2025-08-27T12:26:55Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2508.19828","doi":"10.48550/arxiv.2508.19828","metadata_source":"pith","pith_arxiv_id":"2508.19828","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","venue":"cs.CL","work_id":"2a070440-2167-4398-be97-c2d4c3ee3541","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2508.19828","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:f084207adb3fb924625ac165d3eac45bf087dd17ecfef021cba85738a7af5543","observation_id":"414b6233-aa59-4141-85dd-159a8ff8c713","resolution":{"observed_at":"2026-05-13T04:55:54.660411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:835d89abc760192c601b940b2f5762dc2b6b9d45d729ace96b92841af2fbc3a7","observation_id":"e4564e20-fe4d-4d58-9031-04ca00a0a370","resolution":{"observed_at":"2026-05-12T06:26:23.458818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05665","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:09:59.346546Z","title":"Graph-based agent memory: Taxonomy, techniques, and applications","venue":null,"work_id":"02aaf46d-085a-417b-97df-ff3cf1a8a3a0","year":2026},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:a5c4309d9c06fade5ca2998e4f07da3220793ed74afb52b1160da8afda256c6a","observation_id":"417dc941-4814-43b2-be02-25331c320118","resolution":{"observed_at":"2026-05-12T06:26:23.503352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":"f63c54f2-c686-4182-8f4f-010b7c6674f4","year":2018},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:c4d8156bab42850c327187812076fd999cd69513d3ca9928d2175622a2899edb","observation_id":"27e17f19-82cb-4f5d-8aca-08bb1b549a62","resolution":{"observed_at":"2026-05-12T15:41:40.154677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03193","last_updated":"2019-09-11T06:03:30Z","snapshot_observed_at":"2026-07-06T08:19:51.929437Z","submitted_at":"2019-09-07T06:09:25Z","title":"KG-BERT: BERT for Knowledge Graph Completion","version":2},"cited_work":{"arxiv_id":"1909.03193","doi":"10.48550/arxiv.1909.03193","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.03193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kg-bert: Bert for knowledge graph completion","venue":"arXiv (Cornell University)","work_id":"55ce3e38-1f8c-4c0b-a592-50a2b8e0e00d","year":1909},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/1909.03193","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:4eae654c62e467500d49b64e8f5977b2382cc0ed8414525e520a862cbf94b470","observation_id":"351e7c83-7d6d-4e6b-8915-f342794b22a2","resolution":{"observed_at":"2026-05-12T06:26:23.591946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.10391","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Leanrag: Knowledge-graph-based generation with semantic aggregation and hierarchical retrieval.arXiv preprint arXiv:2508.10391","venue":null,"work_id":"d5a29875-01d7-4979-b616-6ac498381e81","year":null},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:06b3b4cf8a70c91ffbb0ff1145b29ab850995398fce4a0be8c9a959f35823ad8","observation_id":"da8f488d-53ab-48ab-9daa-15bacaab6f28","resolution":{"observed_at":"2026-05-12T06:26:23.645868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04474","last_updated":"2025-08-06T14:25:05Z","snapshot_observed_at":"2026-08-05T23:59:43.742547Z","submitted_at":"2025-08-06T14:25:05Z","title":"TRAIL: Joint Inference and Refinement of Knowledge Graphs with Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.04474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04474","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trail: Joint inference and refinement of knowledge graphs with large language models.arXiv preprint arXiv:2508.04474","venue":null,"work_id":"3e7b7d00-206c-4856-84ed-626d0c0df28e","year":2025},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"cited_paper":"/paper/2508.04474","citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:5e4b44aac76319e36dc0551c194ebe873856f2ed9a8640b73242028f8d8d62ad","observation_id":"aad3e547-563a-4727-b293-ac509e3f4fb6","resolution":{"observed_at":"2026-05-12T06:26:23.553908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b67f1d09-afcb-4db2-9fbb-5bf97ccd4d8b","year":2022},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:b21abda877b04d6c2fd66aa67b8ab26eb1e04c5d6674021c84fbea2177cb2144","observation_id":"8d25e7b5-2462-4e24-bea3-f5355f3cadb6","resolution":{"observed_at":"2026-05-12T15:41:40.145456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"missing evidence","venue":null,"work_id":"99269c48-f7d7-4d13-8942-1e48881afa8e","year":2018},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:f5ba8b068b6b6a44d7aeed29cae9ba7710f558405812121ac49307c8aa367864","observation_id":"af1382cd-c1ec-4479-8087-39eed11eef77","resolution":{"observed_at":"2026-05-12T15:41:40.152133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Camdenton is a city in Camden County, Missouri, United States","venue":null,"work_id":"163293ad-5f50-4849-a2ec-dca6b9201866","year":2011},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:bf3c25fa805c2817ddccc23e61fb35c29d31aaad0df18556789033eb1f4f45b8","observation_id":"ba596462-d236-4cbc-afed-2821b3963189","resolution":{"observed_at":"2026-05-12T15:41:40.147824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"He directed 159 films between 1926 and","venue":null,"work_id":"02656952-c2c7-4ed4-a1fe-2986eac6a159","year":1926},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:0a93e72a7f797eccb1e2e76d614360ab8984bb0225a7fbfe1cb98db016bce186","observation_id":"f2ed37b6-dc4a-453a-a763-514973b40b0b","resolution":{"observed_at":"2026-05-12T15:41:40.149948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fighting with Buffalo Bill","venue":null,"work_id":"2b8e419d-2da1-4414-be0d-d4303d9703be","year":1926},"citing_paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:01.836535Z"},"links":{"citing_paper":"/paper/2605.10488"},"observation_digest":"sha256:06cb02860faa56ee076d6d88760e8cc8f8c14f025351bfc2fe88784ba862c605","observation_id":"0e9490d8-10e3-4982-8ce2-34577351df7c","resolution":{"observed_at":"2026-05-12T15:41:40.157928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.10488","last_updated":"2026-05-11T12:48:31Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T12:48:31Z","title":"DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":1,"verified_exact":27,"verified_fuzzy":6},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2605.10488."}