{"as_of":"2026-08-06T14:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c916666c83fc221867bd4ac5dd62b59c59676d6c8727088a428e4438bf9a8c93","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T06:05:47.948367Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.30518/citation-record","integrity":"/paper/2606.30518/integrity","json":"/paper/2606.30518/citation-record.json","paper":"/paper/2606.30518"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:f6a732973a67ee6d7d76bfa39ab9ec7611e94ecc943776fcd51ce82a353f8317","observation_id":"cc4b9a20-24c8-4888-b3f4-a13ada00a816","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10688","last_updated":"2026-05-30T16:08:24Z","snapshot_observed_at":"2026-08-02T07:46:19.307542Z","submitted_at":"2026-04-12T15:26:14Z","title":"SCOPE: Signal-Calibrated On-Policy Distillation Enhancement with Dual-Path Adaptive Weighting","version":2},"cited_work":{"arxiv_id":"2604.10688","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.10688","snapshot_observed_at":"2026-07-04T16:09:56.987062Z","title":"SCOPE: Signal-Calibrated On-Policy Distillation Enhancement with Dual-Path Adaptive Weighting","venue":"cs.LG","work_id":"c31baac4-7cbe-4749-92ac-4d4051d62ec2","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2604.10688","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:2e15c3e111e5c0452b8db4c4e66086e1127c1456737d6c88d56d24687062c8b1","observation_id":"dd78ed39-9c80-4d6c-b590-21f124385af9","resolution":{"observed_at":"2026-06-30T08:24:27.022728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.02288","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:24:01.050266Z","title":"Unifying group-relative and self-distillation policy optimization via sample routing","venue":null,"work_id":"6dea6cb7-a4e5-478a-ab3c-eeeb335abd51","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:01539b3f4737ee916555db39829deb7d0bd36eb4bad9563b50d9b8316d469847","observation_id":"e29bac27-babd-41bd-93e0-a25ab096f2aa","resolution":{"observed_at":"2026-06-30T08:24:27.018017Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14084","last_updated":"2026-05-21T05:36:13Z","snapshot_observed_at":"2026-07-06T23:01:55.698452Z","submitted_at":"2026-04-15T16:58:24Z","title":"TIP: Token Importance in On-Policy Distillation","version":4},"cited_work":{"arxiv_id":"2604.14084","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14084","snapshot_observed_at":"2026-07-09T21:06:34.840057Z","title":"TIP: Token Importance in On-Policy Distillation","venue":"cs.LG","work_id":"6509a633-b810-4a8d-9de9-8a9b59a768d0","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2604.14084","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:479a49936157608284df49db85865674bf27f195d70e6bb4f4bcc959f9423f46","observation_id":"6566ef28-fd44-488a-bdb7-b9b72c72d6ba","resolution":{"observed_at":"2026-06-30T08:24:27.020367Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Self-rag: Learning to retrieve, generate, and critique through self-reflection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:1aff7a6e13b2e230f6fdd2d0010814c2ea90fd127a43783ccc65ab0ca3d3b85c","observation_id":"1c5db9d9-dcf4-4d66-b3cb-1bafcad12cd5","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Parameters vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:a8bb00813a1636e2eb2c3392319aa7f8fe27f3bff17c7cdbc0ebf2a2653552d2","observation_id":"86b936d6-2403-468b-80b7-1af6e46ff3d0","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Dola: Decoding by contrasting layers improves factuality in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:4dc69c2066bf5d9305db813109899899f94b6f10e2d355d5e4a414afa1de1e81","observation_id":"1f84e3a4-32c9-4e44-a8a9-43c39915a532","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2402.10612","doi":"10.48550/arxiv.2402.10612","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Retrieve only when it needs: Adap- tive retrieval augmentation for hallucination mitigation in large language models","venue":"arXiv (Cornell University)","work_id":"e21c5eb6-a9bb-4c79-9ba3-0b51c248a9df","year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:c38b1fc278c4b7623af7e0dc7262d6ce1d945fae2f0b2f532dfab78a90cf1de5","observation_id":"36a7b0f4-141a-4d0c-813b-30293b079a5c","resolution":{"observed_at":"2026-06-30T08:24:27.012217Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Enhancing noise robustness of retrieval-augmented language models via RAAT","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:ce7b7ca6f7a6799ae69503cb3aa3919aa7131ffaed7a38f0ef39b82b9c59754b","observation_id":"23008632-853f-4c1b-8948-9ba7f64ad588","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25562","last_updated":"2026-04-27T06:21:52Z","snapshot_observed_at":"2026-07-06T22:50:41.736941Z","submitted_at":"2026-03-26T15:35:59Z","title":"Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes","version":2},"cited_work":{"arxiv_id":"2603.25562","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.25562","snapshot_observed_at":"2026-07-07T12:33:45.227324Z","title":"Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes","venue":"cs.LG","work_id":"8e059321-d6e4-4359-89eb-83ecbb93b657","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2603.25562","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:f9da6301b69ea5e665cc42f4f096ef58c507c498272992d41ed7368e5717a78f","observation_id":"4163a970-f866-45f0-9b41-f41f73425b0e","resolution":{"observed_at":"2026-06-30T08:24:27.021355Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Minillm: Knowledge distillation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:a9c591c926683395d32cf08d7e53cb23f2b0e70fce3340e8605bd1129f9e93e2","observation_id":"6753c0f4-5b0f-4414-957f-24e1aed8fdaf","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Deepseek-r1 incentivizes reasoning in LLMs through reinforcement learning.Nature, 645(8081):633–638, sep 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:7fb1f41c5b1653ee434c6550a2c38298f18fac21356ba471da4d153df6e5aa89","observation_id":"32121dfe-d6ed-4041-877e-3e91424a3538","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"REALM: Retrieval-augmented language model pre-training","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:7fd89c03ae0cbbad9829a8ec970c92259c7b8e69454074e85d081337e4ecb87e","observation_id":"d28ad175-4c44-4eae-bb4f-beb723972efd","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Retrieving, rethinking and revising: The chain-of-verification can improve retrieval augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:6342ae22a2649511b62ea9a377fe7b69a5a098161ad140d08394b23e9b8accc8","observation_id":"5f06d4ff-fa3c-4db9-b553-aa7366f9ecab","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:f5a543b568d0e8d01b7264816c967071dfb566c7a96fc277dc5c6958dd0dec74","observation_id":"30b04654-d2a2-4694-a228-822570be84e5","resolution":{"observed_at":"2026-06-30T08:24:27.001110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2503.09516","doi":"10.48550/arxiv.2503.09516","metadata_source":"pith","pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","venue":"cs.CL","work_id":"0e0b7549-2bc4-4574-aa7f-588ffa16eaae","year":2025},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:8654a5e185ccd7308512850af15638178ab8b07b9882c7d5cc8864b4b6d1fed0","observation_id":"43152908-8e76-4545-ab73-5791fe05f387","resolution":{"observed_at":"2026-06-30T08:24:27.004151Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Tug-of-war between knowledge: Exploring and resolving knowledge conflicts in retrieval-augmented language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:94f7047a1877536c7741f4131d68bb800f02cdfaa7be16898534e21cc7b9bb98","observation_id":"39f146a7-525a-4202-b898-71608d9efdda","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.11137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:35:48.689101Z","title":"Woosuk Kwon, Zhuohan Li, Siyuan Zhuang, Ying Sheng, Lianmin Zheng, Cody Hao Yu, Joseph E","venue":null,"work_id":"5e961f0b-b20e-4580-965d-15fb63ec8965","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:26531a08ab65eb2ae7c3d2937011c817b520eba63a617d208958c1f082653069","observation_id":"27654908-bce0-4b88-a7dc-b8652830b0f2","resolution":{"observed_at":"2026-06-30T08:24:27.026445Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:e319ab49d2a167822bb857184b9569b8b48514adf5579112e50fd6f7df2d3a1c","observation_id":"4e27cce0-a059-4a83-ae13-ba261aa14a28","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12854","last_updated":"2024-07-09T08:27:27Z","snapshot_observed_at":"2026-07-06T18:48:00.070861Z","submitted_at":"2024-07-09T08:27:27Z","title":"Scaling Retrieval-Based Language Models with a Trillion-Token Datastore","version":1},"cited_work":{"arxiv_id":"2407.12854","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.12854","snapshot_observed_at":"2026-07-11T00:47:43.022629Z","title":"Shao et al","venue":"cs.CL","work_id":"ae4a7a28-e04c-4956-b87b-af0ddad29266","year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2407.12854","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:59e67a232b5677592ebf542ddb6620632898fa3c542d2eb125fe38ff7172c2b6","observation_id":"07e2fffd-11aa-4800-8344-a18a38b101ed","resolution":{"observed_at":"2026-06-30T08:24:26.992502Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Truthfulqa: Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:db4b4c8783cc9249432de919f2b55b6bef1fe4478eb8a0129bc9006e2287a034","observation_id":"d0ae6354-043b-4708-93d7-2a555dddbf6f","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12345","last_updated":"2025-08-31T14:11:57Z","snapshot_observed_at":"2026-08-06T14:01:47.240169Z","submitted_at":"2025-03-16T03:51:06Z","title":"General Table Question Answering via Answer-Formula Joint Generation","version":3},"cited_work":{"arxiv_id":"2503.12345","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12345","snapshot_observed_at":"2026-07-03T09:57:56.182769Z","title":"arXiv preprint arXiv:2503.12345 , year=","venue":null,"work_id":"2e833a79-dc1e-4389-a961-b9f731ce19d0","year":2025},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2503.12345","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:70eb4196175abaeb17116e501531ceffdbd00456adcaceca256954a9eec91523","observation_id":"9b2f49dc-03ae-4846-b426-fc94415a9b35","resolution":{"observed_at":"2026-06-30T08:24:26.993551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08527","last_updated":"2026-04-09T17:58:02Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:58:02Z","title":"Demystifying OPD: Length Inflation and Stabilization Strategies for Large Language Models","version":1},"cited_work":{"arxiv_id":"2604.08527","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.08527","snapshot_observed_at":"2026-07-04T16:09:56.995110Z","title":"Demystifying OPD: Length Inflation and Stabilization Strategies for Large Language Models","venue":"cs.CL","work_id":"514bb542-92d7-4c33-957b-126674d65983","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2604.08527","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:330e99eda49bea42a21fd3f41db76f1526006ec0790bb94c07b152578103a6a1","observation_id":"c825d042-3a3b-469e-a29b-82aeaefddc21","resolution":{"observed_at":"2026-06-30T08:24:27.013111Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.04942","last_updated":"2026-02-16T18:57:38Z","snapshot_observed_at":"2026-07-06T22:44:37.993093Z","submitted_at":"2026-02-04T18:46:17Z","title":"Privileged Information Distillation for Language Models","version":3},"cited_work":{"arxiv_id":"2602.04942","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.04942","snapshot_observed_at":"2026-07-10T00:26:39.270366Z","title":"Privileged Information Distillation for Language Models","venue":"cs.LG","work_id":"674b7199-1d6e-4f36-89f1-fe1abe5b4db1","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2602.04942","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:08daa2450b4a5bf32e20f80d875e6e2a392a6df365f1b72ededba7e79836ba9d","observation_id":"a22a6ef2-263b-4dd7-943d-b8651e98514e","resolution":{"observed_at":"2026-06-30T08:24:26.996081Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:eb30b72b9dfe2d70cd9c7c6441a800f3abef9358fe950e5f9ee2cc058e8258f1","observation_id":"d2f60ae2-dcc2-4826-aca9-48bd2d1b0f35","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:9c9e603679846fd52cfcd796e60190af6cfb138f70d8f8da4c0a7217dc6ef3f7","observation_id":"27bfc930-868d-4cbe-b5a1-bcc74d59feb6","resolution":{"observed_at":"2026-06-30T08:24:26.998554Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Trusting your evidence: Hallucinate less with context-aware decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:20699e7e0e7f65a1bb511d46253424c9f169e1881df554abfb82c1979737cb18","observation_id":"e98e7298-8504-4459-b605-8edc294a173d","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Conflictbank: a benchmark for evaluating knowledge conflicts in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:fc94b26d1a1a60df20eb8659d921c521fa7896e415dbd9168c9dd89d25d2f135","observation_id":"8bf9925c-e1ae-4d77-aaa9-0ce1237f2490","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07816","last_updated":"2024-03-12T16:54:58Z","snapshot_observed_at":"2026-07-06T17:43:27.034067Z","submitted_at":"2024-03-12T16:54:58Z","title":"Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM","version":1},"cited_work":{"arxiv_id":"2403.07816","doi":"10.48550/arxiv.2403.07816","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.07816","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unchosen experts can contribute too: Unleashing moe models’ power by self-contrast.Advances in Neural Information Processing Systems, 37:136897–136921, 2024a","venue":"arXiv (Cornell University)","work_id":"4e9f3747-cc02-430c-adca-f84f5e3ad4cd","year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2403.07816","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:f6e3a7b2264bec2602443ad62bc209dabd1beeb6c42560d92eb1b48ae9f35663","observation_id":"2ceffadc-58f7-4217-bb2f-f6cf432c556e","resolution":{"observed_at":"2026-06-30T08:24:27.007460Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Knowledge fusion of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:8e207adb42f362f81bda4f59a20ef0042d83ba344bc214da74e086beb25c4997","observation_id":"f3e5f39a-1238-488c-957c-78a1c8b64621","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Astute rag: Over- coming imperfect retrieval augmentation and knowledge conflicts for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:05d07aa7c244702cc4dd9ffc6bfcc2c95d43f849136ef8314d028cb58bcc3b3a","observation_id":"73529d66-77a5-49bd-91c8-de2b61cebd4c","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Retrieval-augmented gen- eration with conflicting evidence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:51898a12e15b1cceae0b455f11692054f06f4a2af5b8a43bcfbeb7fbbf80befb","observation_id":"ee38b844-794f-4ee2-8efb-9988ea6286b7","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Resolving knowledge conflicts in large language models.Conference on Language Modeling, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:1f6d8db29ec25edfa0d082d0aee4a26a95e606a4b72b684aeba7661ac5366285","observation_id":"6e6449e3-b950-47db-b2cd-6c4727992f1a","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13010","last_updated":"2026-05-08T06:38:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-14T17:44:50Z","title":"Lightning OPD: Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation","version":2},"cited_work":{"arxiv_id":"2604.13010","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.13010","snapshot_observed_at":"2026-07-04T10:19:47.155186Z","title":"Lightning OPD: Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation","venue":"cs.LG","work_id":"7dae1a56-9dfd-4f59-a836-8c62d7da923d","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2604.13010","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:2bcecd1c69d0b72179300fb201de8c633ee401f3ee98541aad945be2def18137","observation_id":"10214967-583f-4d93-b6da-efd21542d3fc","resolution":{"observed_at":"2026-06-30T08:24:26.990463Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Adaptive chameleon or stubborn sloth: Revealing the behavior of large language models in knowledge conflicts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:ca4e58ee13d1802db0dbb22ab198fa461e8ed69fa09fd29b7a0fb6baf33ffa76","observation_id":"a5c05676-daab-44bf-b165-37e4a286fa78","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19009","last_updated":"2024-06-27T08:51:06Z","snapshot_observed_at":"2026-08-06T12:11:27.204668Z","submitted_at":"2024-06-27T08:51:06Z","title":"On the Energy Consumption of Rotary Wing and Fixed Wing UAVs in Flying Networks","version":1},"cited_work":{"arxiv_id":"2406.19009","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.19009","snapshot_observed_at":"2026-07-30T01:18:43.537932Z","title":"Info-rag: Information-filtered on-policy retrieval-augmented generation.arXiv preprint arXiv:2406.19009, 2024","venue":null,"work_id":"19c4bd71-f5c0-4fb0-b075-17656d65ed2d","year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2406.19009","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:4a66f774bf01bde384020dafca64a7540caae280636135ffc3a363fc318e4b64","observation_id":"4af1e65e-5cc0-4bb6-8ef1-5359105aea24","resolution":{"observed_at":"2026-07-30T01:18:43.537932Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:05:47.948367Z","title":"Knowledge conflicts for llms: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:648aea0b5c3fce999fd5220ee652f7d462093f6fa8d80362141da9bd89858fa3","observation_id":"93d37acd-a232-4eca-829b-e814b092162c","resolution":{"observed_at":"2026-06-30T06:05:47.948367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12125","last_updated":"2026-02-26T13:26:22Z","snapshot_observed_at":"2026-07-31T18:08:52.441829Z","submitted_at":"2026-02-12T16:14:29Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","version":2},"cited_work":{"arxiv_id":"2602.12125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12125","snapshot_observed_at":"2026-07-09T00:35:48.740330Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","venue":"cs.LG","work_id":"bb968107-1f43-4bf4-aa52-cc58000a6e89","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2602.12125","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:c148c548a98305af8a18442966d7f86a0bdb50ca70620377e34940c59a038fe2","observation_id":"758df0b6-48f3-4d99-a531-a28d34516632","resolution":{"observed_at":"2026-06-30T08:24:27.023775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12275","last_updated":"2026-03-23T13:11:10Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T18:58:28Z","title":"On-Policy Context Distillation for Language Models","version":2},"cited_work":{"arxiv_id":"2602.12275","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12275","snapshot_observed_at":"2026-07-10T00:26:39.252472Z","title":"On-Policy Context Distillation for Language Models","venue":"cs.CL","work_id":"b56a7e15-d864-43f4-9212-59bc7ec70d21","year":2026},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2602.12275","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:d9aec9b4729f6c62476f5512a5cdf4cb2bc732555aaacade72d40546d78bb738","observation_id":"6fc38624-2ef9-4f98-922e-1880da5a3ccb","resolution":{"observed_at":"2026-06-30T08:24:26.974254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00007","last_updated":"2022-02-14T02:25:28Z","snapshot_observed_at":"2026-07-06T12:23:56.415717Z","submitted_at":"2021-12-30T11:00:49Z","title":"Confidence-Aware Multi-Teacher Knowledge Distillation","version":3},"cited_work":{"arxiv_id":"2201.00007","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2201.00007","snapshot_observed_at":"2026-06-30T08:24:27.014273Z","title":"Confidence- aware multi-teacher knowledge distillation","venue":null,"work_id":"5fd62d27-ebd1-4ed6-9cf9-1d6850e1ad6c","year":2022},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2201.00007","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:9ce09089f92ec447fba5234b3f67efb7ca0dfcbd5075c4ba2df1a2b6eedd5cd4","observation_id":"fd77e18b-f24e-4774-8597-c72f7757ea00","resolution":{"observed_at":"2026-06-30T08:24:27.016042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13183","last_updated":"2024-05-21T20:25:19Z","snapshot_observed_at":"2026-07-06T18:17:38.280988Z","submitted_at":"2024-05-21T20:25:19Z","title":"Spectrum and polarization of the Galactic center radio transient ASKAP J173608.2-321635 from THOR-GC and VLITE","version":1},"cited_work":{"arxiv_id":"2405.13183","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.13183","snapshot_observed_at":"2026-06-30T08:24:27.005359Z","title":"Dynamic contrastive decoding for knowledge conflict resolution in large language models.arXiv preprint arXiv:2405.13183, 2024","venue":null,"work_id":"179f160a-c008-4115-9043-318c59630ce7","year":2024},"citing_paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T06:05:47.948367Z"},"links":{"cited_paper":"/paper/2405.13183","citing_paper":"/paper/2606.30518"},"observation_digest":"sha256:ecf1d56e78a3b2fe0fe624225792a530a72acf265a772f2f82cc95d6ed5d67ca","observation_id":"701f96dd-e289-45b6-a869-7285d7975bb5","resolution":{"observed_at":"2026-06-30T08:24:27.006828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.30518","last_updated":"2026-06-29T16:25:13Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-07T00:04:20.023800Z","submitted_at":"2026-06-29T16:25:13Z","title":"Regime-Aware Peer Specialization for Robust RAG under Heterogeneous Knowledge Conflicts"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":21,"verified_exact":17,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2606.30518."}