Pith. sign in

Paper Citation Record · LEDGER

Enhancing LLM Reasoning with Reward-guided Tree Search

As of 22 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 37 inbound Pith citation observations for arXiv:2411.11694.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.11694 v4

Coverage vector

measured 45 of 45 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T18:18:29.201145Z

measured 82 of 82 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 37 of 37 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T04:17:36.582479Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

45 of 45 outbound references displayed

  • verified exact0
  • verified fuzzy14
  • unresolved31
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

0
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

Observation 40544a03-ba65-4d55-afe8-da88ca692ca2 · outbound

This paper cites Scaling Laws for Neural Language Models.

Enhancing LLM Reasoning with Reward-guided Tree Search Scaling Laws for Neural Language Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.310241Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.310241Z digest=sha256:2978f05161651f82b14773e15ec770f241674b775f8f287b2c05ed8ee9df94d4

Observation 7bb06216-212e-46a3-9ef3-d040d8c921f4 · outbound

This paper cites Scaling Laws for Autoregressive Generative Modeling.

Enhancing LLM Reasoning with Reward-guided Tree Search Scaling Laws for Autoregressive Generative Modeling

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.344100Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.344100Z digest=sha256:51267e05fce29566a7ab222f4454cb0ccd060bbe42d8f9fa410d1ba453a37cb6

Observation 1dd5fb6a-2d4c-4429-93ee-ee4335e6946d · outbound

This paper cites Frontiermath: A benchmark for evaluating advanced mathematical reasoning in ai.

Enhancing LLM Reasoning with Reward-guided Tree Search Frontiermath: A benchmark for evaluating advanced mathematical reasoning in ai

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.795690Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.366281Z digest=sha256:3b2751c3d2a0904b47f568105bf2a66a3203e07d7ee7d7361c6a80bab74153d5

Observation 4ac5066e-a6ce-4faa-9838-19f955dcfbe0 · outbound

This paper cites Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R.

Enhancing LLM Reasoning with Reward-guided Tree Search Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.763747Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.372422Z digest=sha256:303b77a54419235cff2c73b507525975c63d4ebf23c67693c4d11c560a5fa640

Observation 30a2aa9a-c29e-4ed3-ba87-f6d1742bac65 · outbound

This paper cites OlympicArena: Benchmarking Multi-discipline Cognitive Reasoning for Superintelligent AI.

Enhancing LLM Reasoning with Reward-guided Tree Search OlympicArena: Benchmarking Multi-discipline Cognitive Reasoning for Superintelligent AI

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.378218Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.378218Z digest=sha256:14fb48069676f467a9af15f57c3d1bc3fc65867040d0f8d78722ed1243bd1708

Observation ec1d76a6-48a7-44f3-a418-5eb639ad89f0 · outbound

This paper cites Ramasesh, Ambrose Slone, Cem Anil, Imanol Schlag, Theo Gutman-Solo, Yuhuai Wu, Behnam Neyshabur, Guy Gur-Ari, and Vedant Misra.

Enhancing LLM Reasoning with Reward-guided Tree Search Ramasesh, Ambrose Slone, Cem Anil, Imanol Schlag, Theo Gutman-Solo, Yuhuai Wu, Behnam Neyshabur, Guy Gur-Ari, and Vedant Misra

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.561010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.394968Z digest=sha256:08e4138c20eaa96aa75e8cf041f270db31d461f0c68ae469e04f7cdb094ea50c

Observation 737e4ce8-9bda-4ba1-9fe4-bb7a34f95d93 · outbound

This paper cites JiuZhang3.0: Efficiently Improving Mathematical Reasoning by Training Small Data Synthesis Models.

Enhancing LLM Reasoning with Reward-guided Tree Search JiuZhang3.0: Efficiently Improving Mathematical Reasoning by Training Small Data Synthesis Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.465584Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.465584Z digest=sha256:907643daa804a9bc253144d92fa5c1ba17136d1aa4f5d3ae6c33b2b56952534d

Observation 09d41113-4bf8-483e-8daa-2d6963bb0129 · outbound

This paper cites Chi, Quoc V.

Enhancing LLM Reasoning with Reward-guided Tree Search Chi, Quoc V

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.539108Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.539108Z digest=sha256:8ac0ffaf9f0ee208312fe6a175a14598c068f15b16a9971b182c1abb95237b13

Observation 9f98697f-12c4-46a1-8bb4-0fc2ca7b5fbf · outbound

This paper cites Le, Ed H.

Enhancing LLM Reasoning with Reward-guided Tree Search Le, Ed H

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.464230Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.556779Z digest=sha256:e9b24bb7930296a8fa8d83e4d8d70540896c8ccc936fffc86d718c197edbf634

Observation 7e60be4a-7aad-4873-976d-35cf7f36ff9c · outbound

This paper cites Tree of thoughts: Deliberate problem solving with large language models.

Enhancing LLM Reasoning with Reward-guided Tree Search Tree of thoughts: Deliberate problem solving with large language models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.588997Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.588997Z digest=sha256:36b72db430fced84e672c74be641c27e110516f5f1d5235b6357a7b93ac3919a

Observation 918bfa91-5e60-46f1-80d1-85a37961af02 · outbound

This paper cites Manning, Stefano Ermon, and Chelsea Finn.

Enhancing LLM Reasoning with Reward-guided Tree Search Manning, Stefano Ermon, and Chelsea Finn

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.601454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.601454Z digest=sha256:bf43979cc563425f0790e3676b3f7f6e37571dd641e398017aa1289b225041f5

Observation e4d55830-be06-45cc-adc7-aada116d036f · outbound

This paper cites Scaling Relationship on Learning Mathematical Reasoning with Large Language Models.

Enhancing LLM Reasoning with Reward-guided Tree Search Scaling Relationship on Learning Mathematical Reasoning with Large Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.625378Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.625378Z digest=sha256:08c5fbb286b89e56df2e400417c68fb4e817f4a5d9cf850c510e3c693d82fe0a

Observation 6fb84a4d-f663-472d-9452-980682100a67 · outbound

This paper cites an unresolved cited work.

Enhancing LLM Reasoning with Reward-guided Tree Search Unresolved cited work

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.647199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.647199Z digest=sha256:3cddf89d9215b8abb16d534761b523c1d23e9ade13ae4661d322041aae6f3e40

Observation 488ca08d-ddb6-4260-8edb-2c3928c173bb · outbound

This paper cites V-STaR: Training Verifiers for Self-Taught Reasoners.

Enhancing LLM Reasoning with Reward-guided Tree Search V-STaR: Training Verifiers for Self-Taught Reasoners

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.664630Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.664630Z digest=sha256:3280fa79d3f5cb377f04d394ecd83835c89607c089f9e1e3aa87f9343ee229e5

Observation 6ed12819-aa6c-4423-95cb-019a044bcab4 · outbound

This paper cites Thinking, fast and slow.

Enhancing LLM Reasoning with Reward-guided Tree Search Thinking, fast and slow

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.678468Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.678468Z digest=sha256:17d8524098cfe8eb2ca665bf3a4cb3e265b57126bfa3887444d3dc780e0cb226

Observation 01464173-489f-45c3-a4c0-83e4dd151b7f · outbound

This paper cites MindStar: Enhancing Math Reasoning in Pre-trained LLMs at Inference Time.

Enhancing LLM Reasoning with Reward-guided Tree Search MindStar: Enhancing Math Reasoning in Pre-trained LLMs at Inference Time

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.693993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.693993Z digest=sha256:a2d03ccc3402058b2c2c159a1708dd8ff30d37d9eba7aa2e8b463799289a7de1

Observation 0299975d-2019-42fe-830d-93279771bf7e · outbound

This paper cites AlphaMath Almost Zero: Process Supervision without Process.

Enhancing LLM Reasoning with Reward-guided Tree Search AlphaMath Almost Zero: Process Supervision without Process

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.716060Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.716060Z digest=sha256:844d1100047b036a9bc30b287677e6017a4eac4d5ce17991ae5541a4d06cc8d2

Observation 4b3640ac-c4ef-4313-8320-1b7cd2f390a1 · outbound

This paper cites ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search.

Enhancing LLM Reasoning with Reward-guided Tree Search ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.721532Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.721532Z digest=sha256:19f5cf8f53ed8110518b981729dd0f798c006ca644a878f13098fc962b130b1c

Observation 18ed73f3-d2b2-445f-a58c-a1d534d36132 · outbound

This paper cites Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents.

Enhancing LLM Reasoning with Reward-guided Tree Search Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.726770Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.726770Z digest=sha256:a385dc7227f8f61c076ba9336c55c2996c00f67f478a9f33231d2507cab72f03

Observation a223b5f6-2f88-4d77-9012-b5e75eb1a5fe · outbound

This paper cites Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking.

Enhancing LLM Reasoning with Reward-guided Tree Search Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.737828Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.737828Z digest=sha256:62ff817f509c32d5c6461ccaf5ebf98c19ecf9a95d218f7d5a37f73b5a9defef

Observation 14448208-30c9-42c7-8eea-fcb20c28321c · outbound

This paper cites Improve Mathematical Reasoning in Language Models by Automated Process Supervision.

Enhancing LLM Reasoning with Reward-guided Tree Search Improve Mathematical Reasoning in Language Models by Automated Process Supervision

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.778051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.778051Z digest=sha256:7d1cbb8d3c01645d517cd53f351106c2f3ea36e741603d85be98bf699dcfa0f5

Observation ecf2f00d-1a7d-41ad-b28f-6ea92b15a06a · outbound

This paper cites LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning.

Enhancing LLM Reasoning with Reward-guided Tree Search LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.820471Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.820471Z digest=sha256:f493140763e69f18e9aba4c5cf1e3e1b03a601db5749f8a32f29f7257198fe6a

Observation 4b5bb62b-2519-4c1c-afa6-75c3769f62bd · outbound

This paper cites O1 replication journey: A strategic progress report – part 1.

Enhancing LLM Reasoning with Reward-guided Tree Search O1 replication journey: A strategic progress report – part 1

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.865692Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.865692Z digest=sha256:327031220b402df8145ed190f4e6c346e71c35d4be32a3cc4d443697eebbf90c

Observation 6499fd6d-09bc-4530-84d2-1b571c7b27d6 · outbound

This paper cites Let’s verify step by step.

Enhancing LLM Reasoning with Reward-guided Tree Search Let’s verify step by step

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.875627Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.875627Z digest=sha256:617b40899983567d200d5ec370b7c4b43aa3ede116e62f6a09e656d23472b339

Observation 0f234cb7-cc65-4168-a0a6-167d8b236bda · outbound

This paper cites PAL: program-aided language models.

Enhancing LLM Reasoning with Reward-guided Tree Search PAL: program-aided language models

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.353076Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.894718Z digest=sha256:210095be4bfd265eb52ec8992f5f2aec6f040a4d07e02b776ce1517dd89e06fa

Observation 088ab913-e4eb-46d4-b0a4-481bbd351e08 · outbound

This paper cites Olympiadbench: A challenging benchmark for promoting AGI with olympiad-level bilingual multimodal scientific problems.

Enhancing LLM Reasoning with Reward-guided Tree Search Olympiadbench: A challenging benchmark for promoting AGI with olympiad-level bilingual multimodal scientific problems

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.250766Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.899913Z digest=sha256:be0d7f39c1733f745ee228828676f0819c5722dfdbd1116e6529de25605d2891

Observation c3ad7678-4af1-4f39-bb78-1f05524b25ad · outbound

This paper cites Mathscale: Scaling instruction tuning for mathematical reasoning.

Enhancing LLM Reasoning with Reward-guided Tree Search Mathscale: Scaling instruction tuning for mathematical reasoning

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.165788Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.905661Z digest=sha256:2e011c43861d532318a22d4b3cdef1fbf78c86c7883d18dc14a5cc2629563fd0

Observation 084d120c-860a-4ae8-9b28-1e99cade36c0 · outbound

This paper cites Let’s verify step by step.

Enhancing LLM Reasoning with Reward-guided Tree Search Let’s verify step by step

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.146770Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.913419Z digest=sha256:46a829bef4fb527678586a7443bc115c4a94292c612a3f021112a85df1c4e4f6

Observation 74a3fc61-a39e-4427-8364-330529043230 · outbound

This paper cites From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function.

Enhancing LLM Reasoning with Reward-guided Tree Search From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.921385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.921385Z digest=sha256:b7d3c20929892a1ba0c8f80f5d4b7ec8ac777472547a9d974f6d0f17010dedb5

Observation 034c2914-d28d-46ab-8d90-79801edc3ba6 · outbound

This paper cites Numinamath: The largest public dataset in ai4maths with 860k pairs of competition math problems and solutions.Hugging Face repository, 2024.

Enhancing LLM Reasoning with Reward-guided Tree Search Numinamath: The largest public dataset in ai4maths with 860k pairs of competition math problems and solutions.Hugging Face repository, 2024

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.932770Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.932770Z digest=sha256:84adfd1d0db07fa034bedf97194b01217553804734e238d5c55580b44968b8ad

Observation 86461794-2906-4038-be76-093ae1da3844 · outbound

This paper cites Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement.

Enhancing LLM Reasoning with Reward-guided Tree Search Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.948433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.948433Z digest=sha256:aab807357120a97476e642df508a2e008e68ae629323ab18e4a6666d4fba4b86

Observation 9f665b48-cce4-4cc6-8130-6c045ebf0541 · outbound

This paper cites an unresolved cited work.

Enhancing LLM Reasoning with Reward-guided Tree Search Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-12T18:18:30.112919Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.964856Z digest=sha256:53149d4afdd938d23bdbbdd3c435e0c1ac1571f5bffbc0e0c8f4a1bba323c447

Observation 12759a53-5d39-4336-b616-1975b2123b32 · outbound

This paper cites Proximal Policy Optimization Algorithms.

Enhancing LLM Reasoning with Reward-guided Tree Search Proximal Policy Optimization Algorithms

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.975986Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.975986Z digest=sha256:c829e5b4971d97af33a7c6774a26e1290023539daa037d7c61d7c20b7c7804dc

Observation 8b848dc9-cdef-4350-80af-f1002bdbbb8d · outbound

This paper cites an unresolved cited work.

Enhancing LLM Reasoning with Reward-guided Tree Search Unresolved cited work

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.982103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.982103Z digest=sha256:b9e8260fd8da23ca9f2bf3f7e2da56cc395f7c1f0d93ac8dc0fd42cd26db4c81

Observation 04a46a22-30cc-4e6d-81ec-43dd6ada93b9 · outbound

This paper cites Math-shepherd: Verify and reinforce llms step-by-step without human annotations.

Enhancing LLM Reasoning with Reward-guided Tree Search Math-shepherd: Verify and reinforce llms step-by-step without human annotations

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:30.017347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.988429Z digest=sha256:7750b7fd0a802960608b9668d6efe34a0c794940862926010fa86b2fb22745c5

Observation e5fd39c7-5215-4061-b35a-b8d312093d5b · outbound

This paper cites Generative reward models.

Enhancing LLM Reasoning with Reward-guided Tree Search Generative reward models

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:29.897942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:28.993942Z digest=sha256:17f317553bc52219ce2d2ab6d85b3af01f171f6b1d764463be2ab07234d1407f

Observation 66efd068-f74c-498a-bf9f-c7772581f912 · outbound

This paper cites Generative Verifiers: Reward Modeling as Next-Token Prediction.

Enhancing LLM Reasoning with Reward-guided Tree Search Generative Verifiers: Reward Modeling as Next-Token Prediction

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:28.999019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:28.999019Z digest=sha256:e46ddb598c3b7f9b637399aa2b1ffce40f9ad3886cc5df0fcb76ab6a55a95d91

Observation 4416b806-da86-46fd-a09a-3af5630185f0 · outbound

This paper cites GPT-4 Technical Report.

Enhancing LLM Reasoning with Reward-guided Tree Search GPT-4 Technical Report

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:29.041699Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:29.041699Z digest=sha256:e80caf30de31c4922af52b1d96443e397759d79a6b676693ada10fac07f08c0b

Observation 72f0f894-04e7-4f00-9b79-4abe50baba23 · outbound

This paper cites Solving math word problems with process- and outcome-based feedback.

Enhancing LLM Reasoning with Reward-guided Tree Search Solving math word problems with process- and outcome-based feedback

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:29.094205Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:29.094205Z digest=sha256:236e5071fd60096579676b990e860d770fd2a26df83fb8949f5bd318e06b2281

Observation b02e949f-f154-4c93-a15f-266c9e003c4b · outbound

This paper cites Active learning principles for in-context learning with large language models.

Enhancing LLM Reasoning with Reward-guided Tree Search Active learning principles for in-context learning with large language models

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:29.866468Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:29.111207Z digest=sha256:c31835cc5a18b75903c68603ecdccc0e0e30a3a804191236ace08874d9ac4cdb

Observation 3d76f1d0-6455-4b90-81a2-360fc0f6fbc3 · outbound

This paper cites Lucas, Peter I.

Enhancing LLM Reasoning with Reward-guided Tree Search Lucas, Peter I

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:29.792660Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:29.140413Z digest=sha256:ce5cfd4199ce578e151ddbf9f93f68788d93d10d5bba90b6331bab5d1cd8469c

Observation 5961bcd3-b0ad-488f-b53f-0a6420f4e017 · outbound

This paper cites Le, Ed H.

Enhancing LLM Reasoning with Reward-guided Tree Search Le, Ed H

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:29.164238Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:29.164238Z digest=sha256:1abb212685f89432333baaf4f75a3632d10a9e45e37ba142539f19d679990aa9

Observation 8cfe6494-9d46-4cd0-b7eb-aa46f45de62b · outbound

This paper cites Smith, Mateusz Paprocki, Ondrej Certík, Sergey B.

Enhancing LLM Reasoning with Reward-guided Tree Search Smith, Mateusz Paprocki, Ondrej Certík, Sergey B

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:29.661799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:29.176150Z digest=sha256:58d7ac982dd2b67fb6c7dca0f9b28fab64b0c0b6fd55e72e387cf18968b2cc63

Observation 030efbf0-a310-440e-a077-06de508227c6 · outbound

This paper cites Llama 3 model card, 2024.

Enhancing LLM Reasoning with Reward-guided Tree Search Llama 3 model card, 2024

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-12T18:18:29.194376Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:18:29.194376Z digest=sha256:2035bd5aa9cc3c547ea11015b713fc40179dac0ea6d79b22cbd458cc09b85650

Observation ca136927-4e35-4d68-9a8c-1fa095638f7d · outbound

This paper cites Qwen2.5: A party of foundation models, September 2024.

Enhancing LLM Reasoning with Reward-guided Tree Search Qwen2.5: A party of foundation models, September 2024

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T18:18:29.620805Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T18:18:29.201145Z digest=sha256:e8f14b7ac52c15911fbdd8f277804cf86229da69fe1fb4300e2c887141bfdbfd

Pith citing papers

Observation b747b821-6732-41e9-9d67-8e74890b5ad4 · inbound

Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems cites this paper.

Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-18T00:35:31.441347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-18T00:35:31.375020Z digest=sha256:02af9bbb0da235d89bafc2bdf44c0ad9b1076bac1e2320ab8e6fd2baae792bec

Observation e0b758f3-fc61-4ee2-90a1-52ac400d43be · inbound

Process-Supervised Reward Models for Verifying Clinical Note Generation: A Scalable Approach Guided by Domain Expertise cites this paper.

Process-Supervised Reward Models for Verifying Clinical Note Generation: A Scalable Approach Guided by Domain Expertise Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-11T14:03:18.869765Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:03:18.869765Z digest=sha256:7f22558118c6f690f5440ba2c10de3d009699f0825a59d614f61ee41b8f0a186

Observation 6185c839-4d9e-40cb-b798-ea7dcb445a4a · inbound

Reasoning Through Execution: Unifying Process and Outcome Rewards for Code Generation cites this paper.

Reasoning Through Execution: Unifying Process and Outcome Rewards for Code Generation Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-11T11:40:13.585941Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:40:13.585941Z digest=sha256:c869e56a1c60fdccc151b5c1e17ba25a1a9cf3a53f976b2a970d33560291803d

Observation 240854d5-6f3e-4d93-b7b2-5728c82054bd · inbound

YuLan-Mini: An Open Data-efficient Language Model cites this paper.

YuLan-Mini: An Open Data-efficient Language Model Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.648063Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.648063Z digest=sha256:24f5f2e24bed243c365393a9c7d824e7748182015ac6a649693f355f7e995d28

Observation 64c1d21d-f7f0-4ba4-8da7-f8367e41a2d1 · inbound

Think More, Hallucinate Less: Mitigating Hallucinations via Dual Process of Fast and Slow Thinking cites this paper.

Think More, Hallucinate Less: Mitigating Hallucinations via Dual Process of Fast and Slow Thinking Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-10T22:35:49.072270Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:35:49.072270Z digest=sha256:47d41e951545d946182f51fba971d539baac32ff1ad5b9af6207be68cde121b5

Observation 6aa1724b-52d3-41c5-8e25-14eb70d34815 · inbound

Search-o1: Agentic Search-Enhanced Large Reasoning Models cites this paper.

Search-o1: Agentic Search-Enhanced Large Reasoning Models Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-05-13T17:36:27.714815Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-13T17:36:27.515468Z digest=sha256:34d4137f7d383598e9d89dd1d00bb05683329b850814fda3ef649081e832cc78

Observation 469eb988-d7a0-4a34-963f-64d166bb9b21 · inbound

Rethinking External Slow-Thinking: From Snowball Errors to Probability of Correct Reasoning cites this paper.

Rethinking External Slow-Thinking: From Snowball Errors to Probability of Correct Reasoning Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-10T14:15:46.035216Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T14:15:46.035216Z digest=sha256:322173d58ebefc4e85a3f481828c9f40a34cc88cb8ea18ade2377892f24cebfd

Observation 5ed12ada-9c94-4b3d-b128-ccc7f6903693 · inbound

Holistically Guided Monte Carlo Tree Search for Intricate Information Seeking cites this paper.

Holistically Guided Monte Carlo Tree Search for Intricate Information Seeking Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-08T21:40:26.812624Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T21:40:26.812624Z digest=sha256:a9da622a6fe9df5d083e50983ba8e1cb4ea1027d35e51fe003ff57980fe7b16d

Observation 9a181384-00a6-44af-a6d7-0d6ebdc467e3 · inbound

On the Emergence of Thinking in LLMs I: Searching for the Right Intuition cites this paper.

On the Emergence of Thinking in LLMs I: Searching for the Right Intuition Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-08T14:25:53.387950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-08T14:25:53.387950Z digest=sha256:011f964619ac718f2591116a3a2978cd650777a32d524b161e76dc18a1b025e7

Observation 0826ecf3-81b6-4e94-976d-9fe0cd154d7f · inbound

Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey cites this paper.

Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 228

Resolution
verified exact
arxiv_id, observed 2026-05-15T17:18:53.527788Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-15T17:18:52.996467Z digest=sha256:f3d0f270aba32a6b696185316fd5a7cea3527c659207d5d3f9d710c29c931b22

Observation 4731a328-5df5-481d-91b0-31ab3a55478f · inbound

Large Language Model Agent: A Survey on Methodology, Applications and Challenges cites this paper.

Large Language Model Agent: A Survey on Methodology, Applications and Challenges Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 108

Resolution
verified exact
arxiv_id, observed 2026-05-22T21:52:10.570222Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-22T21:51:34.309870Z digest=sha256:bde057079fbf327a17659dd298803dda7d18076faff4383dfa25bf1fe41494d3

Observation bf5c0af6-8095-42df-8dee-1038de5f2ae5 · inbound

A Survey of Slow Thinking-based Reasoning LLMs using Reinforced Learning and Inference-time Scaling Law cites this paper.

A Survey of Slow Thinking-based Reasoning LLMs using Reinforced Learning and Inference-time Scaling Law Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-16T00:48:17.713077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:48:17.713077Z digest=sha256:2937e78b216e9a92a9484c77591847a14ddc1038c6c330014aed3fda3da24130

Observation 4ead05e3-d961-4c35-a037-d4341b120842 · inbound

Accelerating Large Language Model Reasoning via Speculative Search cites this paper.

Accelerating Large Language Model Reasoning via Speculative Search Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-16T04:17:36.582479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-16T04:17:36.582479Z digest=sha256:e3a4a43fe652b17313f30f5b9d216bcbf9011a40875dc977de0fd5ec9d2e4a22

Observation 34a2bdca-22ac-4241-bad8-498eb7451526 · inbound

ZeroSearch: Incentivize the Search Capability of LLMs without Searching cites this paper.

ZeroSearch: Incentivize the Search Capability of LLMs without Searching Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-17T17:44:13.470477Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-17T17:44:13.310155Z digest=sha256:174e70b0ee61889c3d1d464b47f762bf5b1d55d7e0ac476a22ccdf50bdac7eec

Observation 56fe818b-eff3-4366-8fa8-a5ab4045d2de · inbound

ZeroSearch: Incentivize the Search Capability of LLMs without Searching cites this paper.

ZeroSearch: Incentivize the Search Capability of LLMs without Searching Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-22T16:06:45.978606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-22T16:05:04.715678Z digest=sha256:e51584a23921036e90d552127d99025916f2453ab95bf31b09446bdfe9d2774a

Observation a80ca779-edbd-4c3a-80ff-78034a3c8734 · inbound

EquivPruner: Boosting Efficiency and Quality in LLM-Based Search via Action Pruning cites this paper.

EquivPruner: Boosting Efficiency and Quality in LLM-Based Search via Action Pruning Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T15:06:00.892822Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:06:00.892822Z digest=sha256:d54203a7a59ea0e222c5ce2d5d6a2f1bc6bcd135ad50add4e670c7d0ff3f0f4c

Observation 9f9ffe20-ea0b-4f37-9e95-257e32a45eae · inbound

Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning cites this paper.

Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T14:45:17.406362Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:45:17.406362Z digest=sha256:05a2fe452721404a04f74bdd40f7cda684c3d90d72725197c7dad67f287b5e9b

Observation f9b003d7-32fe-4b32-ab05-8497d578fab5 · inbound

Reward Model Generalization for Compute-Aware Test-Time Reasoning cites this paper.

Reward Model Generalization for Compute-Aware Test-Time Reasoning Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T14:42:27.309575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:42:27.309575Z digest=sha256:6d4f68e1d9333959c8ce4820929aa9f56f7f7db7a7fb04be24e20c2d5e63ff3b

Observation c4faad56-4c78-4937-9050-740d21861537 · inbound

Evaluation is All You Need: Strategic Overclaiming of LLM Reasoning Capabilities Through Evaluation Design cites this paper.

Evaluation is All You Need: Strategic Overclaiming of LLM Reasoning Capabilities Through Evaluation Design Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T10:40:21.212589Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T10:40:21.212589Z digest=sha256:a0a5799565a0646ac615a0b417273fbd76e5b832b378537bd11882d6e41ddb3b

Observation fa67507f-6f74-448c-a283-ebf292b38dd5 · inbound

Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models cites this paper.

Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T05:46:43.398130Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:46:43.398130Z digest=sha256:4e66c08dbc173f031dfb4e7877b5326b8aebb7fa0e55e2b9461e35427418dc05

Observation a4cc418c-f9fe-4f52-9f47-9608d2518715 · inbound

VReST: Enhancing Reasoning in Large Vision-Language Models through Tree Search and Self-Reward Mechanism cites this paper.

VReST: Enhancing Reasoning in Large Vision-Language Models through Tree Search and Self-Reward Mechanism Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T05:09:19.582648Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T05:09:19.582648Z digest=sha256:ddfb8f8c93c8e480cd9542f4303da7fc93a1fd1fe1c8199d8877e805e0c34205

Observation 33c4bf2c-0c93-4766-a506-f9a81f20da20 · inbound

Ctrl-Z Sampling: Scaling Diffusion Sampling with Controlled Random Zigzag Explorations cites this paper.

Ctrl-Z Sampling: Scaling Diffusion Sampling with Controlled Random Zigzag Explorations Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T22:59:12.842671Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:59:12.842671Z digest=sha256:f593a9416ce5e0c3d6d11ee645c147c4ba0b37762eed9def17a6f62622998df7

Observation 584f3c12-ceca-4bef-98aa-47e5b7b2a949 · inbound

Decoupling Knowledge and Reasoning in LLMs: An Exploration Using Cognitive Dual-System Theory cites this paper.

Decoupling Knowledge and Reasoning in LLMs: An Exploration Using Cognitive Dual-System Theory Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-15T18:22:13.374617Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T18:22:13.374617Z digest=sha256:c7283944189b7a42f9ac212a61fcc8b95c30a99c6edeb69831cf7847c0f13952

Observation a1bcfbea-21e6-46dd-96b8-9aa36ae0c15b · inbound

Let's Revise Step-by-Step: A Unified Local Search Framework for Code Generation with LLMs cites this paper.

Let's Revise Step-by-Step: A Unified Local Search Framework for Code Generation with LLMs Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-05T22:09:46.543585Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T22:09:46.543585Z digest=sha256:eb31f5b29b0bdfcfcc1c4c1ba8299db2d91f4bfcd9191ed02758422d7be84710

Observation ea005420-8fac-45fb-be45-2bb5acf2547f · inbound

From Trial-and-Error to Improvement: A Systematic Analysis of LLM Exploration Mechanisms in RLVR cites this paper.

From Trial-and-Error to Improvement: A Systematic Analysis of LLM Exploration Mechanisms in RLVR Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-05T22:03:28.144048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T22:03:28.144048Z digest=sha256:ec415a3f8f26f5518a29484c1116492f1995e2674c94082464d655e0ff4747b7

Observation 0a8439d8-5404-4d31-926f-f181fcc433c4 · inbound

Why Does Reasoning Length Converge? Unveiling the Underfitting-Overfitting Trade-off in Chain-of-Thought cites this paper.

Why Does Reasoning Length Converge? Unveiling the Underfitting-Overfitting Trade-off in Chain-of-Thought Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-05T10:31:37.800280Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T10:31:37.800280Z digest=sha256:7548ce845d0c9506b05c4e9ac02a66ecf55cbf7a79ac665840a5e5bdeabad8d1

Observation 608e598d-cbc1-4caa-a836-3e3fc350f3af · inbound

Sticker-TTS: Learn to Utilize Historical Experience with a Sticker-driven Test-Time Scaling Framework cites this paper.

Sticker-TTS: Learn to Utilize Historical Experience with a Sticker-driven Test-Time Scaling Framework Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-05T05:45:02.737120Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T05:45:02.737120Z digest=sha256:445749be4bd6843c57b4261f2a4dc0b18a74c4f60f4973611496c870b830f5dd

Observation 84507aa2-47d9-400c-a03c-d6af0fc57d8d · inbound

Retrieval-of-Thought: Efficient Reasoning via Reusing Thoughts cites this paper.

Retrieval-of-Thought: Efficient Reasoning via Reusing Thoughts Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 13

Resolution
verified exact
arxiv_id, observed 2026-05-18T13:42:38.635096Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-18T13:42:07.883909Z digest=sha256:a96ec871bf318806a2f631e3629fabb3f74c5951a291c1499c4bc0ff916ff2ad

Observation 98ab1b38-b39d-4c71-bf79-bb57fba73fd2 · inbound

When control meets large language models: From words to dynamics cites this paper.

When control meets large language models: From words to dynamics Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 97

Resolution
verified exact
arxiv_id, observed 2026-05-21T14:54:13.213179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-21T14:52:44.632671Z digest=sha256:b64802bd31565344384452a73e182e1d8240f2aeec6cf0176601b727355868c6

Observation 537f8259-853b-49fa-bb55-17839a0768ab · inbound

PARM: Pipeline-Adapted Reward Model cites this paper.

PARM: Pipeline-Adapted Reward Model Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 23

Resolution
verified exact
arxiv_id, observed 2026-05-10T09:28:39.510004Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-10T05:15:26.015817Z digest=sha256:5b0ea608b44f06bb8a5f3f183fab51d633bbdefdaaf78e108ea1774df7450dda

Observation 3bf1b1a0-94ac-456c-b1eb-0ba4e401864d · inbound

A Communication-Theoretic Framework for LLM Agents: Cost-Aware Adaptive Reliability cites this paper.

A Communication-Theoretic Framework for LLM Agents: Cost-Aware Adaptive Reliability Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 71

Resolution
metadata mismatch
arxiv_id, observed 2026-05-12T07:26:27.522360Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-05-12T03:03:05.715652Z digest=sha256:ffde54bce12baa63d05a649b076015798d02585ad029cf869315f6751f2c4fbe

Observation 0d972d20-b559-42bb-839a-8127afaf352d · inbound

Density Field State Space Models: 1-Bit Distillation, Efficient Inference, and Knowledge Organization in Mamba-2 cites this paper.

Density Field State Space Models: 1-Bit Distillation, Efficient Inference, and Knowledge Organization in Mamba-2 Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 14

Resolution
metadata mismatch
arxiv_id, observed 2026-07-01T09:05:37.131006Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-07-01T08:55:37.926334Z digest=sha256:9a0bf685eff30286c1360df65371e9f85911415c1ffd80b336b69ae7a2ba768f

Observation cc708544-57ba-42b6-ab7d-8b6a0db9d35b · inbound

MODE-RAG: Manifold Outlier Diagnosis and Energy-based Retrieval-Augmented Generation Evaluation cites this paper.

MODE-RAG: Manifold Outlier Diagnosis and Energy-based Retrieval-Augmented Generation Evaluation Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-07-03T20:08:56.384800Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-06-27T01:35:46.913390Z digest=sha256:2ac876409ab36eed26d7a0f84c4e2639d3e2fcb4e47e566e8ea396bbb4654388

Observation 7eb9e57f-a20d-44e6-8a98-f55fef3c7839 · inbound

Beyond Fixed Budgets: Characterizing the Inelasticity and Limitations of Tree-of-Thought Reasoning Strategies cites this paper.

Beyond Fixed Budgets: Characterizing the Inelasticity and Limitations of Tree-of-Thought Reasoning Strategies Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-06-30T18:44:59.789825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-06-30T18:38:48.512777Z digest=sha256:e1ef9051e094ad38a2903675de83913d84f52c742fd1a2cbc1586390001e3faa

Observation 1ecd146f-269f-4c5c-9404-be0d44e64969 · inbound

SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning cites this paper.

SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 285

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T09:59:44.800993Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-06-26T09:19:50.623741Z digest=sha256:dc867aa777a03746c859cd110ab29dd5e0e3fd14bb7ff48331063f4ead75dec2

Observation e4709ce6-424a-4ecb-92f6-efdc6d7ccd9d · inbound

SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning cites this paper.

SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 284

Resolution
metadata mismatch
arxiv_id, observed 2026-07-01T18:55:59.426665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-06-29T01:18:19.195007Z digest=sha256:e00f33278bc9d57850b9a36b094d0941da0ab6f02810d2efac01a44a5dfafd5a

Observation 40872ebf-2c4b-4d17-ad29-4a171c8d48d5 · inbound

TreeThink: A Modular Tree Search Library for Mathematical Reasoning with LLMs cites this paper.

TreeThink: A Modular Tree Search Library for Mathematical Reasoning with LLMs Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 123

Resolution
unresolved
no resolver link, observed 2026-07-14T05:57:23.399019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-14T05:57:23.399019Z digest=sha256:b4e4230cb55ae8a7c03a8ed316a10bdfd3dab959016126cff409faf09ec50445