Pith. sign in

Paper Citation Record · LEDGER

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models

As of 9 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2506.19466.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.19466 v2

Coverage vector

measured 30 of 30 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:12:07.910923Z

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

30 of 30 outbound references displayed

  • verified exact0
  • verified fuzzy17
  • unresolved13
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b28f482c-f30e-4069-9102-48002d62b226 · outbound

This paper cites Dense passage retrieval for open-domain question answering,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Dense passage retrieval for open-domain question answering,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.344904Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:05.095697Z digest=sha256:1485753e8b738a98502b4469b7a7601c1743e25b4fe7cbab65273c1be1bfda6a

Observation b456b0fe-f99f-428a-b5e0-3657a4598904 · outbound

This paper cites Text Embeddings by Weakly-Supervised Contrastive Pre-training.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Text Embeddings by Weakly-Supervised Contrastive Pre-training

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.170334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.170334Z digest=sha256:449bd623756d300882abd7747eaa2d68ab187f6c410bba490ff4a41715ee7f36

Observation a14e490f-a1e1-4c33-b0fe-a68a7d81baeb · outbound

This paper cites FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.245732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.245732Z digest=sha256:7a07c58be72490dc59f812da0e3e33a51056e8601cfb81ed2d535e43590a5fb1

Observation b209c25f-16bf-460a-a077-e843f2a1ce1c · outbound

This paper cites HybridFlow: A Flexible and Efficient RLHF Framework.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models HybridFlow: A Flexible and Efficient RLHF Framework

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.297026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.297026Z digest=sha256:38d4b87e4ac3674dff8ed5992e0675c4ca551e7f50f4e2e81d79ee0510396709

Observation d2657462-a267-4b9b-965e-2db8927dbc53 · outbound

This paper cites Wikidata: a free collaborative knowledgebase,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Wikidata: a free collaborative knowledgebase,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.186818Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:05.351642Z digest=sha256:818fccd543984830ffe58adbbbd7357c78094e8b5edfcefae2043902c2310ecc

Observation 6f692e0f-9a36-420c-a77a-1bc7cf1da85b · outbound

This paper cites Constructing A multi-hop QA dataset for comprehensive evaluation of reasoning steps,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Constructing A multi-hop QA dataset for comprehensive evaluation of reasoning steps,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.069329Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:05.452781Z digest=sha256:6ba85acb2f75c9c7ca4c5b733e207aa7d30f5a2e098fe56248d5a4606cb290c6

Observation 40be7c40-705a-4692-8f61-023ed46fd783 · outbound

This paper cites Hotpotqa: A dataset for diverse, explainable multi-hop question answering,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Hotpotqa: A dataset for diverse, explainable multi-hop question answering,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.984588Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:05.505525Z digest=sha256:c7c1e3fdcb71a37456c4db17607d662e51f5d8d933b4a534ba7a47df6a781ccc

Observation 8c9347db-16f0-45bb-ba9d-7d54f55aba41 · outbound

This paper cites Musique: Multihop questions via single-hop question composition,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Musique: Multihop questions via single-hop question composition,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.829325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:05.601056Z digest=sha256:f8babb393472e3783c5cc067f7ccfe92e4a233ccfd69373205b419b0df1134f7

Observation 6450132c-0e5b-47b5-9f59-1122737e9215 · outbound

This paper cites Dense text retrieval based on pretrained language models: A survey,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Dense text retrieval based on pretrained language models: A survey,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.703511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:05.674945Z digest=sha256:8f3c26502aed7b72d787730e141e22f221ab7fd057de4ad46a6218ec72adbc27

Observation 9bfeb630-36f1-4b1a-be7d-15f5428bf719 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.739682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.739682Z digest=sha256:2748298b60328140b5b044679fad176566eab36005080c37f7b725f9bf0a1c3a

Observation e258f0cc-ba7b-42e7-9d36-7ccf52781576 · outbound

This paper cites Measuring and narrow- ing the compositionality gap in language models,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Measuring and narrow- ing the compositionality gap in language models,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.550540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:05.819735Z digest=sha256:1a1dbb97addab4bfd532ac7b443d2e655925a23b65a0c4fc34528115eeacfd00

Observation 0ff7d332-dcbf-48da-9744-4dcde3b6636b · outbound

This paper cites Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.872413Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.872413Z digest=sha256:dcf1789dceec26bd104f5f9c42aed607ecdf0e6e1a2eef65e187fabfa7635e18

Observation 42f763d3-caf8-4495-a44b-374b559cd64e · outbound

This paper cites s1: Simple test-time scaling.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models s1: Simple test-time scaling

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.928572Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.928572Z digest=sha256:239a81dd86465796ce3ca89acfe8637522cac4c6dcdcf80eae333f3430f816e9

Observation 1672311e-6c52-42a0-89d0-1b61e1f9b726 · outbound

This paper cites Star: Bootstrapping reasoning with reasoning,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Star: Bootstrapping reasoning with reasoning,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.385853Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:06.016903Z digest=sha256:e4608782ab7a5fdb8d5de97d5fc506b3f6cdc681bf3e92aac34f3b2efe6e83b0

Observation baebe486-1ace-4d6c-b545-2adfd06a3280 · outbound

This paper cites Chain-of-thought prompting elicits reasoning in large language models,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Chain-of-thought prompting elicits reasoning in large language models,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.272443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:06.159651Z digest=sha256:faf09b23f9d567d5a5c77cd0f8cb82599d32ca1cdc0aac0b5fff6b735216b353

Observation eb846aeb-6d90-4727-bb14-c174096e2d13 · outbound

This paper cites Claude 3.7 sonnet and claude code,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Claude 3.7 sonnet and claude code,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.155434Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:06.268786Z digest=sha256:a00297013c6d3c04187819470055b16c1d13774e89e14ec1c12324b5225c14e3

Observation 666e854f-8694-4af3-9503-9ff282f7e764 · outbound

This paper cites Learning to reason with LLMs,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Learning to reason with LLMs,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.049985Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:06.394461Z digest=sha256:1c0249c7089cad29b4c472c76cbe072d53a58a80332e4a27de55077e96fca1cb

Observation 93d76a24-1926-42c6-a41e-01496f84d72a · outbound

This paper cites Corrective Retrieval Augmented Generation.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Corrective Retrieval Augmented Generation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:06.524660Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:06.524660Z digest=sha256:c811813f93e94cc42e82b60e5243dc252aa0effb02eb46049c3e56b15b24a5b7

Observation 2ded99ab-9ff1-4a4d-9aac-966e85c8cf3d · outbound

This paper cites Self-rag: Learning to retrieve, generate, and critique through self-reflection,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Self-rag: Learning to retrieve, generate, and critique through self-reflection,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.914395Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:06.669760Z digest=sha256:0396208636dd9d771b6d3c0795e6a5bb5e24fff958af8d33d2bd477ee9bb1f1c

Observation c46de477-cbaf-4cfc-a8f6-9a5bd52babb7 · outbound

This paper cites Interleaving retrieval with chain- of-thought reasoning for knowledge-intensive multi-step questions,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Interleaving retrieval with chain- of-thought reasoning for knowledge-intensive multi-step questions,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.749270Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:06.775608Z digest=sha256:1ffb4d9103f80ca132bc56e55c8653a96341ef888125fc51cd5dee03bbe71626

Observation 68727962-532d-4d20-9350-0acf85bbec17 · outbound

This paper cites Enhancing retrieval-augmented large language models with iterative retrieval-generation synergy,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Enhancing retrieval-augmented large language models with iterative retrieval-generation synergy,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.608468Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:06.897310Z digest=sha256:c9f707b9f6f058a6a54418e217d28e641d997c3ac58d0b2fdd8b12e997f71d07

Observation 928a7eef-c0e7-40ce-96ce-f78a9cfaf476 · outbound

This paper cites Hugginggpt: Solving AI tasks with chatgpt and its friends in hugging face,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Hugginggpt: Solving AI tasks with chatgpt and its friends in hugging face,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.483283Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:07.060761Z digest=sha256:7f313717019e3f5fb348454b447eac415183724d0b2e8cf53af0523e672c971d

Observation c1f16e2b-ed7f-4310-82ac-01e630ba5290 · outbound

This paper cites Agentboard: An analytical evaluation board of multi-turn LLM agents,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Agentboard: An analytical evaluation board of multi-turn LLM agents,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.358651Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:07.174006Z digest=sha256:e26aeb7827f1995f421fdf7a239ed55c829b631a654e2e5104b54b4f3272ffc5

Observation b2b5741f-5f9a-4168-bd57-cfb611c8c69f · outbound

This paper cites Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.292016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.292016Z digest=sha256:67086a504e836bd4c158369acbdecbcac72317799c239073c52c65fbca0ed70b

Observation 488cc88f-5cdc-43ce-8c9a-fc21d0ad6400 · outbound

This paper cites Toolformer: Language models can teach themselves to use tools,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Toolformer: Language models can teach themselves to use tools,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.399789Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.399789Z digest=sha256:8a69f6f6c6107051ed5202bdc8c1735735f59ae7d2229cdd33ef8b613a8993b2

Observation 45fa2f83-20da-49ce-9a68-b323a055354d · outbound

This paper cites Retrieval-Augmented Generation for Large Language Models: A Survey.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Retrieval-Augmented Generation for Large Language Models: A Survey

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.518791Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.518791Z digest=sha256:6a4f281a4d654b42419f7bfcaa31ea2dfb37d11b7bd8e64462c56a7bbf1391d1

Observation b7d9e762-9a52-4293-ac28-0bbd49793e2b · outbound

This paper cites Learning to plan for retrieval-augmented large language models from knowledge graphs,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Learning to plan for retrieval-augmented large language models from knowledge graphs,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.250087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:12:07.614369Z digest=sha256:156fb5549838db86ff6b0a1cd330c5cbb1f1d66951c398cb627ad0b77b0a485a

Observation 540ce1d4-3a5b-4d22-acfb-47d197481a22 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.710550Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.710550Z digest=sha256:db611b8432a02414098cee64b92d83442c5dfb005b3f2a567b991afbbd666db1

Observation 4e434e1e-7fc2-40ee-9add-daf756dc936c · outbound

This paper cites Baichuan alignment technical report,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Baichuan alignment technical report,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.860861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.860861Z digest=sha256:72f11f8f488b24abdd10085054e1a11ebea08a3fe6fca8b6ee8976af05c8fd28

Observation 1a78b8b8-2a12-4384-8966-402c0b4d2ebb · outbound

This paper cites Qwen2.5 Technical Report.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Qwen2.5 Technical Report

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.910923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.910923Z digest=sha256:8962b3dee58f1403a6a1c38318ccce1a79f2e399d3d75542047c0135b10fe952

Pith citing papers

No inbound Pith citation observations are available.