Pith. sign in

Paper Citation Record · LEDGER

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models

As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2506.19466.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.19466 v2

Coverage vector

measured 30 of 30 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:12:07.910923Z

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

30 of 30 outbound references displayed

  • verified exact0
  • verified fuzzy17
  • unresolved13
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b28f482c-f30e-4069-9102-48002d62b226 · outbound

This paper cites Dense passage retrieval for open-domain question answering,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Dense passage retrieval for open-domain question answering,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.344904Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:05.095697Z digest=sha256:343541970e564b1f76ddef2b039ede343a929688d2bdda5039e7a07774aae311

Observation b456b0fe-f99f-428a-b5e0-3657a4598904 · outbound

This paper cites Text Embeddings by Weakly-Supervised Contrastive Pre-training.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Text Embeddings by Weakly-Supervised Contrastive Pre-training

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.170334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.170334Z digest=sha256:449bd623756d300882abd7747eaa2d68ab187f6c410bba490ff4a41715ee7f36

Observation a14e490f-a1e1-4c33-b0fe-a68a7d81baeb · outbound

This paper cites FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.245732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.245732Z digest=sha256:7a07c58be72490dc59f812da0e3e33a51056e8601cfb81ed2d535e43590a5fb1

Observation b209c25f-16bf-460a-a077-e843f2a1ce1c · outbound

This paper cites HybridFlow: A Flexible and Efficient RLHF Framework.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models HybridFlow: A Flexible and Efficient RLHF Framework

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.297026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.297026Z digest=sha256:38d4b87e4ac3674dff8ed5992e0675c4ca551e7f50f4e2e81d79ee0510396709

Observation d2657462-a267-4b9b-965e-2db8927dbc53 · outbound

This paper cites Wikidata: a free collaborative knowledgebase,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Wikidata: a free collaborative knowledgebase,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.186818Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:05.351642Z digest=sha256:c92039b9d311664f9a250aff7747f49251111f3b85919df94334684025692e76

Observation 6f692e0f-9a36-420c-a77a-1bc7cf1da85b · outbound

This paper cites Constructing A multi-hop QA dataset for comprehensive evaluation of reasoning steps,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Constructing A multi-hop QA dataset for comprehensive evaluation of reasoning steps,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.069329Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:05.452781Z digest=sha256:22c7b8da77376b69f389fd2aae9798501ead90302cb79685dfc109f76bb9f12a

Observation 40be7c40-705a-4692-8f61-023ed46fd783 · outbound

This paper cites Hotpotqa: A dataset for diverse, explainable multi-hop question answering,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Hotpotqa: A dataset for diverse, explainable multi-hop question answering,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.984588Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:05.505525Z digest=sha256:c82e34f00c9450801cd3ee18969ab2eb0f24dabec92c30c721736c29b9049c0e

Observation 8c9347db-16f0-45bb-ba9d-7d54f55aba41 · outbound

This paper cites Musique: Multihop questions via single-hop question composition,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Musique: Multihop questions via single-hop question composition,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.829325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:05.601056Z digest=sha256:0378d5b83e16576d4e0f11eec695360d0500d4fb2e23feadaea9d0e84ccb2b82

Observation 6450132c-0e5b-47b5-9f59-1122737e9215 · outbound

This paper cites Dense text retrieval based on pretrained language models: A survey,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Dense text retrieval based on pretrained language models: A survey,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.703511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:05.674945Z digest=sha256:2a01a2abc88e89346802c4bfbf957efe1996a940c63327f2eb9e9ee03c107f7a

Observation 9bfeb630-36f1-4b1a-be7d-15f5428bf719 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.739682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.739682Z digest=sha256:2748298b60328140b5b044679fad176566eab36005080c37f7b725f9bf0a1c3a

Observation e258f0cc-ba7b-42e7-9d36-7ccf52781576 · outbound

This paper cites Measuring and narrow- ing the compositionality gap in language models,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Measuring and narrow- ing the compositionality gap in language models,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.550540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:05.819735Z digest=sha256:463c7dce60f7110adf6393f9aa99da96b8a7ba62757797795f0dac851c8d6698

Observation 0ff7d332-dcbf-48da-9744-4dcde3b6636b · outbound

This paper cites Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.872413Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.872413Z digest=sha256:dcf1789dceec26bd104f5f9c42aed607ecdf0e6e1a2eef65e187fabfa7635e18

Observation 42f763d3-caf8-4495-a44b-374b559cd64e · outbound

This paper cites s1: Simple test-time scaling.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models s1: Simple test-time scaling

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.928572Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.928572Z digest=sha256:239a81dd86465796ce3ca89acfe8637522cac4c6dcdcf80eae333f3430f816e9

Observation 1672311e-6c52-42a0-89d0-1b61e1f9b726 · outbound

This paper cites Star: Bootstrapping reasoning with reasoning,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Star: Bootstrapping reasoning with reasoning,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.385853Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:06.016903Z digest=sha256:9eef2b3765f7ba6d0c01055a81be85964f951d5dee3f02b0011ada0214ae8d1e

Observation baebe486-1ace-4d6c-b545-2adfd06a3280 · outbound

This paper cites Chain-of-thought prompting elicits reasoning in large language models,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Chain-of-thought prompting elicits reasoning in large language models,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.272443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:06.159651Z digest=sha256:9a66c44f17930c2f64a659dcc08a058b56f8d78d6f6f4a25f490ab97e2cc9188

Observation eb846aeb-6d90-4727-bb14-c174096e2d13 · outbound

This paper cites Claude 3.7 sonnet and claude code,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Claude 3.7 sonnet and claude code,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.155434Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:06.268786Z digest=sha256:1519f2d27a057ad644b94689a742ec6f02e49454c82e89adea4bf4cd289e9950

Observation 666e854f-8694-4af3-9503-9ff282f7e764 · outbound

This paper cites Learning to reason with LLMs,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Learning to reason with LLMs,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.049985Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:06.394461Z digest=sha256:109a79e39797a7891045cc588dfaff93e47c800dbb03d712ea296cf0ab9149dc

Observation 93d76a24-1926-42c6-a41e-01496f84d72a · outbound

This paper cites Corrective Retrieval Augmented Generation.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Corrective Retrieval Augmented Generation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:06.524660Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:06.524660Z digest=sha256:c811813f93e94cc42e82b60e5243dc252aa0effb02eb46049c3e56b15b24a5b7

Observation 2ded99ab-9ff1-4a4d-9aac-966e85c8cf3d · outbound

This paper cites Self-rag: Learning to retrieve, generate, and critique through self-reflection,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Self-rag: Learning to retrieve, generate, and critique through self-reflection,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.914395Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:06.669760Z digest=sha256:fb85e6b40afc4fd1923d0f45c74e479c73308df82075a90bbc042b6854401a6c

Observation c46de477-cbaf-4cfc-a8f6-9a5bd52babb7 · outbound

This paper cites Interleaving retrieval with chain- of-thought reasoning for knowledge-intensive multi-step questions,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Interleaving retrieval with chain- of-thought reasoning for knowledge-intensive multi-step questions,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.749270Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:06.775608Z digest=sha256:1806ffa567ea6f950c1f175655efcd41a2eb332211195418a560bf98e69e9a21

Observation 68727962-532d-4d20-9350-0acf85bbec17 · outbound

This paper cites Enhancing retrieval-augmented large language models with iterative retrieval-generation synergy,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Enhancing retrieval-augmented large language models with iterative retrieval-generation synergy,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.608468Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:06.897310Z digest=sha256:a1a100e93094c5aed60a8ebff8f638b0ac4b51f014130d3c61c6e2413c906abe

Observation 928a7eef-c0e7-40ce-96ce-f78a9cfaf476 · outbound

This paper cites Hugginggpt: Solving AI tasks with chatgpt and its friends in hugging face,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Hugginggpt: Solving AI tasks with chatgpt and its friends in hugging face,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.483283Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:07.060761Z digest=sha256:71383adbcae8ba0516a2eceabb6df9b69d546c1432a095baed23659d3d70e0c1

Observation c1f16e2b-ed7f-4310-82ac-01e630ba5290 · outbound

This paper cites Agentboard: An analytical evaluation board of multi-turn LLM agents,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Agentboard: An analytical evaluation board of multi-turn LLM agents,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.358651Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:07.174006Z digest=sha256:885c0ccd4fe7f5ad3825ebcd0cbcd19786bc3bfe129498711084b7051b898898

Observation b2b5741f-5f9a-4168-bd57-cfb611c8c69f · outbound

This paper cites Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.292016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.292016Z digest=sha256:67086a504e836bd4c158369acbdecbcac72317799c239073c52c65fbca0ed70b

Observation 488cc88f-5cdc-43ce-8c9a-fc21d0ad6400 · outbound

This paper cites Toolformer: Language models can teach themselves to use tools,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Toolformer: Language models can teach themselves to use tools,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.399789Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.399789Z digest=sha256:8a69f6f6c6107051ed5202bdc8c1735735f59ae7d2229cdd33ef8b613a8993b2

Observation 45fa2f83-20da-49ce-9a68-b323a055354d · outbound

This paper cites Retrieval-Augmented Generation for Large Language Models: A Survey.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Retrieval-Augmented Generation for Large Language Models: A Survey

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.518791Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.518791Z digest=sha256:6a4f281a4d654b42419f7bfcaa31ea2dfb37d11b7bd8e64462c56a7bbf1391d1

Observation b7d9e762-9a52-4293-ac28-0bbd49793e2b · outbound

This paper cites Learning to plan for retrieval-augmented large language models from knowledge graphs,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Learning to plan for retrieval-augmented large language models from knowledge graphs,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.250087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:12:07.614369Z digest=sha256:f5389feae881a472bb9a2e277484056ed4b9b315cfb46eacc5e129e3fd1460df

Observation 540ce1d4-3a5b-4d22-acfb-47d197481a22 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.710550Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.710550Z digest=sha256:db611b8432a02414098cee64b92d83442c5dfb005b3f2a567b991afbbd666db1

Observation 4e434e1e-7fc2-40ee-9add-daf756dc936c · outbound

This paper cites Baichuan alignment technical report,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Baichuan alignment technical report,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.860861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.860861Z digest=sha256:72f11f8f488b24abdd10085054e1a11ebea08a3fe6fca8b6ee8976af05c8fd28

Observation 1a78b8b8-2a12-4384-8966-402c0b4d2ebb · outbound

This paper cites Qwen2.5 Technical Report.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Qwen2.5 Technical Report

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.910923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.910923Z digest=sha256:8962b3dee58f1403a6a1c38318ccce1a79f2e399d3d75542047c0135b10fe952

Pith citing papers

No inbound Pith citation observations are available.