Pith. sign in

Paper Citation Record · LEDGER

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models

As of 21 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2506.19466.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.19466 v2

Coverage vector

measured 30 of 30 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:12:07.910923Z

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

30 of 30 outbound references displayed

  • verified exact0
  • verified fuzzy17
  • unresolved13
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b28f482c-f30e-4069-9102-48002d62b226 · outbound

This paper cites Dense passage retrieval for open-domain question answering,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Dense passage retrieval for open-domain question answering,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.344904Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:05.095697Z digest=sha256:e4d4bd84b50efefba5d2f67b112449f027065e152ab20c36ddb0b34f15581ea4

Observation b456b0fe-f99f-428a-b5e0-3657a4598904 · outbound

This paper cites Text Embeddings by Weakly-Supervised Contrastive Pre-training.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Text Embeddings by Weakly-Supervised Contrastive Pre-training

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.170334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.170334Z digest=sha256:d4b148d23ddbeebb1d41071d3d0551c055598d5a92c3317de96850b4865b0f5c

Observation a14e490f-a1e1-4c33-b0fe-a68a7d81baeb · outbound

This paper cites FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.245732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.245732Z digest=sha256:a6cbd4afdad6a209160357624832318d9b5e643e71aaeb1366947a1933b15bc6

Observation b209c25f-16bf-460a-a077-e843f2a1ce1c · outbound

This paper cites HybridFlow: A Flexible and Efficient RLHF Framework.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models HybridFlow: A Flexible and Efficient RLHF Framework

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.297026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.297026Z digest=sha256:07aaadbf49a9b430530c2023edabd17e1f52df2fa6ecccd35bfdc51fb551377b

Observation d2657462-a267-4b9b-965e-2db8927dbc53 · outbound

This paper cites Wikidata: a free collaborative knowledgebase,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Wikidata: a free collaborative knowledgebase,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.186818Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:05.351642Z digest=sha256:5d582ae337eead332981e386a874268b93d7e1a2e370a424d492e40e791f0e9b

Observation 6f692e0f-9a36-420c-a77a-1bc7cf1da85b · outbound

This paper cites Constructing A multi-hop QA dataset for comprehensive evaluation of reasoning steps,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Constructing A multi-hop QA dataset for comprehensive evaluation of reasoning steps,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:10.069329Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:05.452781Z digest=sha256:77961f3f30c2eb169c7cbed378369385fdd5d247a6f877a968586111749f2030

Observation 40be7c40-705a-4692-8f61-023ed46fd783 · outbound

This paper cites Hotpotqa: A dataset for diverse, explainable multi-hop question answering,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Hotpotqa: A dataset for diverse, explainable multi-hop question answering,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.984588Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:05.505525Z digest=sha256:e8dfc60168cef7137cb3639a20ae1b8dbfb1a3c2b3e6c77344d9ac51f0312daf

Observation 8c9347db-16f0-45bb-ba9d-7d54f55aba41 · outbound

This paper cites Musique: Multihop questions via single-hop question composition,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Musique: Multihop questions via single-hop question composition,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.829325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:05.601056Z digest=sha256:1713f738c75074f55076ad40fcd15272b36426edb4c5900b46398574cb6b6373

Observation 6450132c-0e5b-47b5-9f59-1122737e9215 · outbound

This paper cites Dense text retrieval based on pretrained language models: A survey,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Dense text retrieval based on pretrained language models: A survey,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.703511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:05.674945Z digest=sha256:c9e432c29d8020c52563accfd8faba2f1052dd85a219c23b9879fdf230a61e82

Observation 9bfeb630-36f1-4b1a-be7d-15f5428bf719 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.739682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.739682Z digest=sha256:c7e89a29effd17f72083dd73292538e047b961ff95b3c78ddacb20b89d0f7e67

Observation e258f0cc-ba7b-42e7-9d36-7ccf52781576 · outbound

This paper cites Measuring and narrow- ing the compositionality gap in language models,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Measuring and narrow- ing the compositionality gap in language models,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.550540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:05.819735Z digest=sha256:61ffe13d5caee4b20f9e2c7051d8cbcdfdda79a244acfdb9b51e54c418dccdce

Observation 0ff7d332-dcbf-48da-9744-4dcde3b6636b · outbound

This paper cites Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.872413Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.872413Z digest=sha256:89f980e0a2c997a45cec980c76a07dd6bf0cd82f82ac6a85ec9ce4d35080f9f6

Observation 42f763d3-caf8-4495-a44b-374b559cd64e · outbound

This paper cites s1: Simple test-time scaling.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models s1: Simple test-time scaling

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:05.928572Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:05.928572Z digest=sha256:29e22d89b932f053fd0db91873124a7cdcb8a405b2c01d18d3fe6cf876d9d5ab

Observation 1672311e-6c52-42a0-89d0-1b61e1f9b726 · outbound

This paper cites Star: Bootstrapping reasoning with reasoning,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Star: Bootstrapping reasoning with reasoning,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.385853Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:06.016903Z digest=sha256:6463be52f2dd25405346602304f6a97cf1ba26bf6a91f744617dd7ec0b07d02c

Observation baebe486-1ace-4d6c-b545-2adfd06a3280 · outbound

This paper cites Chain-of-thought prompting elicits reasoning in large language models,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Chain-of-thought prompting elicits reasoning in large language models,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.272443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:06.159651Z digest=sha256:c2f0c2e2d31518254b9589c3710444aa6e1c9d5d06ac56df82ffa952c0d56d71

Observation eb846aeb-6d90-4727-bb14-c174096e2d13 · outbound

This paper cites Claude 3.7 sonnet and claude code,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Claude 3.7 sonnet and claude code,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.155434Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:06.268786Z digest=sha256:35793d003c9f6f468d3a6d6f109fbef11589467a53c7a9bc8385aaf4fe84a090

Observation 666e854f-8694-4af3-9503-9ff282f7e764 · outbound

This paper cites Learning to reason with LLMs,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Learning to reason with LLMs,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:09.049985Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:06.394461Z digest=sha256:5be55358f1c869f8eeebb20b37aee03375e96a541374c03be18c4a9aa5106203

Observation 93d76a24-1926-42c6-a41e-01496f84d72a · outbound

This paper cites Corrective Retrieval Augmented Generation.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Corrective Retrieval Augmented Generation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:06.524660Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:06.524660Z digest=sha256:ab83bfeaba9352ea69b1c930ed26c9d5c10047b6097b610c50126b9305cdaf5b

Observation 2ded99ab-9ff1-4a4d-9aac-966e85c8cf3d · outbound

This paper cites Self-rag: Learning to retrieve, generate, and critique through self-reflection,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Self-rag: Learning to retrieve, generate, and critique through self-reflection,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.914395Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:06.669760Z digest=sha256:923d1a0860afdf3b92583781f3381de51970bc951e96038dc66eb79fbdbe5062

Observation c46de477-cbaf-4cfc-a8f6-9a5bd52babb7 · outbound

This paper cites Interleaving retrieval with chain- of-thought reasoning for knowledge-intensive multi-step questions,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Interleaving retrieval with chain- of-thought reasoning for knowledge-intensive multi-step questions,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.749270Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:06.775608Z digest=sha256:b250171bd831c885a184a741b2f03fc6e2a2987f6966486cb98eb0ab255203f8

Observation 68727962-532d-4d20-9350-0acf85bbec17 · outbound

This paper cites Enhancing retrieval-augmented large language models with iterative retrieval-generation synergy,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Enhancing retrieval-augmented large language models with iterative retrieval-generation synergy,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.608468Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:06.897310Z digest=sha256:43b0e7afe384ef998e85f03f81a4acf767f130431f4362fd7904e4f4d0cd8406

Observation 928a7eef-c0e7-40ce-96ce-f78a9cfaf476 · outbound

This paper cites Hugginggpt: Solving AI tasks with chatgpt and its friends in hugging face,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Hugginggpt: Solving AI tasks with chatgpt and its friends in hugging face,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.483283Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:07.060761Z digest=sha256:32b0effec1e24075ea4e7bca2f426fb90dfec6ec85611156628452d7826ac929

Observation c1f16e2b-ed7f-4310-82ac-01e630ba5290 · outbound

This paper cites Agentboard: An analytical evaluation board of multi-turn LLM agents,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Agentboard: An analytical evaluation board of multi-turn LLM agents,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.358651Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:07.174006Z digest=sha256:c1cf06aa6e83b1f98ba43104739811f5f1673d256556da87e6d7807bd5fb391f

Observation b2b5741f-5f9a-4168-bd57-cfb611c8c69f · outbound

This paper cites Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.292016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.292016Z digest=sha256:f16222d9e223cc921b0909ae1cb7c436ea08f76d9824cd57850c2fccc527941c

Observation 488cc88f-5cdc-43ce-8c9a-fc21d0ad6400 · outbound

This paper cites Toolformer: Language models can teach themselves to use tools,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Toolformer: Language models can teach themselves to use tools,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.399789Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.399789Z digest=sha256:67dc0cea6aceaf095ea7d6a95707421d5d7822b7992f98ffa17fdb1307be1bef

Observation 45fa2f83-20da-49ce-9a68-b323a055354d · outbound

This paper cites Retrieval-Augmented Generation for Large Language Models: A Survey.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Retrieval-Augmented Generation for Large Language Models: A Survey

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.518791Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.518791Z digest=sha256:08227b97686f95c55f17f71d02fdd07d2263a221c79f066cca43df87b38337da

Observation b7d9e762-9a52-4293-ac28-0bbd49793e2b · outbound

This paper cites Learning to plan for retrieval-augmented large language models from knowledge graphs,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Learning to plan for retrieval-augmented large language models from knowledge graphs,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:12:08.250087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-06T23:12:07.614369Z digest=sha256:eb2934d8fc0acacd016ebe09f3bdbb282a6eb931d2ada25211078d74344fac4c

Observation 540ce1d4-3a5b-4d22-acfb-47d197481a22 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.710550Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.710550Z digest=sha256:37e4ebca1b82e0e5db07cc4089b28908454a5e4ccbc38232b8ce22f867568db0

Observation 4e434e1e-7fc2-40ee-9add-daf756dc936c · outbound

This paper cites Baichuan alignment technical report,.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Baichuan alignment technical report,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.860861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.860861Z digest=sha256:e681b2a87b5bc1ea02d30e74bf20018f42f32c0517773f5d78209dfa6d0d2d05

Observation 1a78b8b8-2a12-4384-8966-402c0b4d2ebb · outbound

This paper cites Qwen2.5 Technical Report.

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models Qwen2.5 Technical Report

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:07.910923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:07.910923Z digest=sha256:fc4708c9e7600ba8f7dae5345025f6bc9807fd43902651b743ad8322c35d9f99

Pith citing papers

No inbound Pith citation observations are available.