Pith. sign in

Paper Citation Record · LEDGER

Policy Guided Tree Search for Enhanced LLM Reasoning

As of 17 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 4 inbound Pith citation observations for arXiv:2502.06813.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.06813 v1

Coverage vector

measured 77 of 77 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-09T11:20:31.971505Z

measured 81 of 81 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 4 of 4 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-09T00:45:00.847714Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-07-09T00:45:49.122831Z

Reference resolution

77 of 77 outbound references displayed

  • verified exact0
  • verified fuzzy11
  • unresolved66
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation f118f27f-9ac2-4118-bfb1-8bc681efe191 · outbound

This paper cites write newline.

Policy Guided Tree Search for Enhanced LLM Reasoning write newline

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.699067Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.699067Z digest=sha256:6e9124e21aafdab62dda1cdfa7a082ebbd74b63dd3e1171464f23a7072e57642

Observation 7cda15ef-6e8a-4415-bf5e-0c31c00ee476 · outbound

This paper cites GPT-4 Technical Report.

Policy Guided Tree Search for Enhanced LLM Reasoning GPT-4 Technical Report

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.703893Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.703893Z digest=sha256:c7aa51a2ec28f5c441fed243d1276ac34911f4728f6a8f7e17aa7496fa3e3354

Observation 521ee828-f36d-4836-8127-b83234e6343f · outbound

This paper cites On the Bottleneck of Graph Neural Networks and its Practical Implications.

Policy Guided Tree Search for Enhanced LLM Reasoning On the Bottleneck of Graph Neural Networks and its Practical Implications

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.707926Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.707926Z digest=sha256:4ea26320dddd31717a39e74f09b924b7874cde470d38c1f1677c9251fb9ca234

Observation 424ed346-75f6-4d6b-a0de-c10a262eb682 · outbound

This paper cites Graph of thoughts: Solving elaborate problems with large language models.

Policy Guided Tree Search for Enhanced LLM Reasoning Graph of thoughts: Solving elaborate problems with large language models

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.826455Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.711962Z digest=sha256:2d794c98c1b2f38e249cb2bef2c30eed35a550a8d7f3f4054a1796fe14c56b76

Observation 358e0789-95bb-482e-a85e-b84ad6b10d50 · outbound

This paper cites Large Language Monkeys: Scaling Inference Compute with Repeated Sampling.

Policy Guided Tree Search for Enhanced LLM Reasoning Large Language Monkeys: Scaling Inference Compute with Repeated Sampling

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.715617Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.715617Z digest=sha256:9c1fe9c636453569c1cb0d6ae6464e7fcc7bfc64058a701c891d39fdb0137fe3

Observation d5864c9c-a105-4feb-acb5-eb68ad1222df · outbound

This paper cites Are More LLM Calls All You Need? Towards Scaling Laws of Compound Inference Systems.

Policy Guided Tree Search for Enhanced LLM Reasoning Are More LLM Calls All You Need? Towards Scaling Laws of Compound Inference Systems

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.719368Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.719368Z digest=sha256:aa7a7693f694e6f5711d6cbb4f21d8827934e98a8686137c5259ea5ec0d34db9

Observation 2c4e8457-5087-4387-96ce-9071b2628413 · outbound

This paper cites AutoManual: Constructing Instruction Manuals by LLM Agents via Interactive Environmental Learning.

Policy Guided Tree Search for Enhanced LLM Reasoning AutoManual: Constructing Instruction Manuals by LLM Agents via Interactive Environmental Learning

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.723133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.723133Z digest=sha256:8cb39c57e5723bf81782f24603e2281bbceb7135083aa87cdb032e2abda69018

Observation 2de69ca6-b006-4c9c-bb3b-ce789d55485e · outbound

This paper cites Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks.

Policy Guided Tree Search for Enhanced LLM Reasoning Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.727353Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.727353Z digest=sha256:d4b37c85df7d3fe1f4c45b5640b0bf24afeff618f88344e60361d68b25da3a09

Observation 0b605823-9856-4717-a0d6-38c6b29370c4 · outbound

This paper cites Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs.

Policy Guided Tree Search for Enhanced LLM Reasoning Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.731422Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.731422Z digest=sha256:25ee9020c52733e882dc04045a7d4affda8075f6ddca352b37359fa4cfabb30a

Observation c20159ef-305c-4225-b259-8f28a4aaf78d · outbound

This paper cites Training Verifiers to Solve Math Word Problems.

Policy Guided Tree Search for Enhanced LLM Reasoning Training Verifiers to Solve Math Word Problems

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.736133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.736133Z digest=sha256:2cfbb7ef961272d86a93d1a3445def253684085505a02d2f99268351252019f3

Observation 6b424d76-ff8d-4726-86b0-f2df89c1b702 · outbound

This paper cites Opencompass: A universal evaluation platform for foundation models.

Policy Guided Tree Search for Enhanced LLM Reasoning Opencompass: A universal evaluation platform for foundation models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.739771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.739771Z digest=sha256:85bab07e0f745f3ff71bd7f14fae604e3fbd83213cfc7d0962dcd9021d56c685

Observation b24d0833-f800-47ef-b496-df20bcde9757 · outbound

This paper cites The Llama 3 Herd of Models.

Policy Guided Tree Search for Enhanced LLM Reasoning The Llama 3 Herd of Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.743145Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.743145Z digest=sha256:3b8df5022961c7c534f64faadd6e71ac4bbdd9e2fc2a75e22224675f253513e4

Observation 14d03701-0746-40b7-a80d-933ec45adb87 · outbound

This paper cites A Generalization of Transformer Networks to Graphs.

Policy Guided Tree Search for Enhanced LLM Reasoning A Generalization of Transformer Networks to Graphs

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.746699Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.746699Z digest=sha256:84d98764425c05c1d3061d002030b51a35def77a498fdc6147242a339fa9db6b

Observation 42826f10-840a-476b-8e95-c03692270f8a · outbound

This paper cites Graph Neural Networks with Learnable Structural and Positional Representations.

Policy Guided Tree Search for Enhanced LLM Reasoning Graph Neural Networks with Learnable Structural and Positional Representations

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.750244Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.750244Z digest=sha256:4c94cf714a16f5f65de41ca5814a727ad11935e1afc971ad1ec03a0ac5018925

Observation 4ef57d7c-c201-481b-b7ab-80775d952152 · outbound

This paper cites Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training.

Policy Guided Tree Search for Enhanced LLM Reasoning Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.753947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.753947Z digest=sha256:0927336e8921a7c51710a9bfde1ce96e97920e609778b4a58f039d75d5ae591d

Observation 384b8047-8f33-4ab7-b5be-456709c5c2bb · outbound

This paper cites Interpretable Contrastive Monte Carlo Tree Search Reasoning.

Policy Guided Tree Search for Enhanced LLM Reasoning Interpretable Contrastive Monte Carlo Tree Search Reasoning

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.757466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.757466Z digest=sha256:3cefae565fc4dff7c165d40716d707fafb85ca402627ff635361ef245437f981

Observation 5a89156c-c02a-4631-9b16-4993c6963023 · outbound

This paper cites Did aristotle use a laptop? a question answering benchmark with implicit reasoning strategies.

Policy Guided Tree Search for Enhanced LLM Reasoning Did aristotle use a laptop? a question answering benchmark with implicit reasoning strategies

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.761155Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.761155Z digest=sha256:3cea7c7ce2b2e455445ffeb9db9aaf1ed52ca03b52f3e78cd9c1ec3ea00fafb5

Observation f4a5b532-5837-4693-a6b8-3820b1f548cc · outbound

This paper cites Monte-carlo tree search as regularized policy optimization.

Policy Guided Tree Search for Enhanced LLM Reasoning Monte-carlo tree search as regularized policy optimization

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.805102Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.764558Z digest=sha256:5c55911c1d9d6bcd08be5d58f0d477f07cfc4d2bd9dd6859b79d7ee4b01c379f

Observation 79310749-c6d7-44e4-8dfc-338637dfe9ee · outbound

This paper cites Reasoning with Language Model is Planning with World Model.

Policy Guided Tree Search for Enhanced LLM Reasoning Reasoning with Language Model is Planning with World Model

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.767853Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.767853Z digest=sha256:1f66b6a6318d0cb2c72d1d82d19ff6ea4a46132b688f2cd21c4611e9621a38e3

Observation 9e76c176-aa0a-4cfc-bfd0-464c0244565c · outbound

This paper cites LLM Reasoners: New Evaluation, Library, and Analysis of Step-by-Step Reasoning with Large Language Models.

Policy Guided Tree Search for Enhanced LLM Reasoning LLM Reasoners: New Evaluation, Library, and Analysis of Step-by-Step Reasoning with Large Language Models

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.771367Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.771367Z digest=sha256:849f5b7e921f32ebd3adb696db43b264dc1d83e4bc85acc2dece052928f2e0b0

Observation e25244ba-94d1-4422-a4f4-a64516b26871 · outbound

This paper cites E., Nilsson, N.

Policy Guided Tree Search for Enhanced LLM Reasoning E., Nilsson, N

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.775056Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.775056Z digest=sha256:0b4bde931d8d07466d80365b3560c9c40f450f31753fdf966bf64159330373fb

Observation 610fd814-6513-4da7-9499-bed96ecb4d2b · outbound

This paper cites GLoRe: When, Where, and How to Improve LLM Reasoning via Global and Local Refinements.

Policy Guided Tree Search for Enhanced LLM Reasoning GLoRe: When, Where, and How to Improve LLM Reasoning via Global and Local Refinements

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.778590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.778590Z digest=sha256:e35ba8960b5271056ce1492b3be8e893a07ad50bc54e5f8891b2ebf2ed7d7b49

Observation c58d6740-0b55-4a45-9afc-a8a40ffc14db · outbound

This paper cites Measuring Mathematical Problem Solving With the MATH Dataset.

Policy Guided Tree Search for Enhanced LLM Reasoning Measuring Mathematical Problem Solving With the MATH Dataset

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.782099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.782099Z digest=sha256:4bd329c88c308079b83bd36c6636a005bbc422e5de075562fb5eeda773a87d65

Observation 694c9302-820a-455e-8074-ea8432b2dda7 · outbound

This paper cites A Closer Look at the Self-Verification Abilities of Large Language Models in Logical Reasoning.

Policy Guided Tree Search for Enhanced LLM Reasoning A Closer Look at the Self-Verification Abilities of Large Language Models in Logical Reasoning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.785806Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.785806Z digest=sha256:ab19f62090c063827f7ccb76faf829f75ee9fd80f5a6cbacfaa51a0f311bf5fd

Observation e93f86b6-a9b4-4430-aaf4-8555735818a9 · outbound

This paper cites Towards Reasoning in Large Language Models: A Survey.

Policy Guided Tree Search for Enhanced LLM Reasoning Towards Reasoning in Large Language Models: A Survey

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.789530Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.789530Z digest=sha256:8ad774abefeffd455d2f1ce42896f2e97789b251071301a4d2f5434564321cbf

Observation 8cda804f-7155-4452-8dc3-5de7a2055668 · outbound

This paper cites Large Language Models Cannot Self-Correct Reasoning Yet.

Policy Guided Tree Search for Enhanced LLM Reasoning Large Language Models Cannot Self-Correct Reasoning Yet

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.793430Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.793430Z digest=sha256:6d60c7734b7d6cbeb0fb2234484066267797c419d08e1fb3652547e41c7ad3f7

Observation 8f7deca7-1356-44be-9fb7-c91c1e474d18 · outbound

This paper cites Mistral 7B.

Policy Guided Tree Search for Enhanced LLM Reasoning Mistral 7B

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.797186Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.797186Z digest=sha256:a2f6e5102f1df5cba1eb1e21443ae26ff1b842be37726cf650d67fdf928ac7c2

Observation 2ff43ab7-7195-408e-a605-50e2d6d8fb76 · outbound

This paper cites Can large language models reason and plan? Annals of the New York Academy of Sciences, 1534 0 (1): 0 15--18, 2024.

Policy Guided Tree Search for Enhanced LLM Reasoning Can large language models reason and plan? Annals of the New York Academy of Sciences, 1534 0 (1): 0 15--18, 2024

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.789185Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.800950Z digest=sha256:d778e0d552d7cb3b12fe9fb7ec1cf41acd467e2287954b3565cd95525ae3b486

Observation 03cc6b19-91f4-42af-b502-393f4edf18d8 · outbound

This paper cites LLMs Can't Plan, But Can Help Planning in LLM-Modulo Frameworks.

Policy Guided Tree Search for Enhanced LLM Reasoning LLMs Can't Plan, But Can Help Planning in LLM-Modulo Frameworks

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.804544Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.804544Z digest=sha256:6d793e55b316b45c914110c2c11a49abc6bcccf595733c437c871c71088eed6d

Observation 8a1bc270-94f6-4c71-b1b3-8cc6d3ef6b62 · outbound

This paper cites Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?.

Policy Guided Tree Search for Enhanced LLM Reasoning Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.808143Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.808143Z digest=sha256:cbdd0bb669f4a2415f4b8657bbd0af9c14aef01d71f76f63e9751f393f53daf2

Observation e4ecee8c-1157-4e74-ac92-72308834ce73 · outbound

This paper cites an unresolved cited work.

Policy Guided Tree Search for Enhanced LLM Reasoning Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-09T11:20:32.778249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.811669Z digest=sha256:da930debc0e432d1d91964ef869f56d74cf84f2825696cbfcd3459315c595ed0

Observation e85eba5f-3949-4ef9-a36d-3238801862fd · outbound

This paper cites Grace: Discriminator-guided chain-of-thought reasoning.

Policy Guided Tree Search for Enhanced LLM Reasoning Grace: Discriminator-guided chain-of-thought reasoning

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.814944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.814944Z digest=sha256:56a915fcb86adcb6bebc4897d299a3ff2e98f622a76221c4c754c83aeb9982b3

Observation 82d17d86-d6ad-4a3c-aa98-d55e4f6a6255 · outbound

This paper cites S., Reid, M., Matsuo, Y., and Iwasawa, Y.

Policy Guided Tree Search for Enhanced LLM Reasoning S., Reid, M., Matsuo, Y., and Iwasawa, Y

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.818263Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.818263Z digest=sha256:13a96871230bcba2cb2b7228adc2961c9224b4353ed1cf6b8d669e8250b62946

Observation 34a6b8ff-83d4-4c05-9b23-9069f4a7b6a3 · outbound

This paper cites Rethinking graph transformers with spectral attention.

Policy Guided Tree Search for Enhanced LLM Reasoning Rethinking graph transformers with spectral attention

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.821720Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.821720Z digest=sha256:fc6bf2449fad4ebf9b88d42ec15a8832039abb2ef4c16ea7be2e858f80dc52dc

Observation 9dff5b69-8f07-46c1-8c7b-1734cd5a5c81 · outbound

This paper cites Chain of Code: Reasoning with a Language Model-Augmented Code Emulator.

Policy Guided Tree Search for Enhanced LLM Reasoning Chain of Code: Reasoning with a Language Model-Augmented Code Emulator

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.824871Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.824871Z digest=sha256:2626f880e4ccadc09981cb3c6eb292200b31d3917e27cdfd79941fa56acf8398

Observation b629c2ea-858f-4963-acf6-9b26600e017b · outbound

This paper cites Making Large Language Models Better Reasoners with Step-Aware Verifier.

Policy Guided Tree Search for Enhanced LLM Reasoning Making Large Language Models Better Reasoners with Step-Aware Verifier

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.828323Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.828323Z digest=sha256:1f9f6bb7d176bc1651c1d04c7d9b17f6811443f38dc9da949b078eec90d1f973

Observation 7a0d4a6f-b75e-4b60-ba10-07f1c979025b · outbound

This paper cites Let's Verify Step by Step.

Policy Guided Tree Search for Enhanced LLM Reasoning Let's Verify Step by Step

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.831749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.831749Z digest=sha256:b2cc6ea5ab12cc83b37739c2b037237d31508be582f9041a3151c8c675326627

Observation 8e34e2e1-dd0f-4d51-9774-3d11ac69efbe · outbound

This paper cites Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems.

Policy Guided Tree Search for Enhanced LLM Reasoning Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.835298Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.835298Z digest=sha256:9dec065fe587ae4e72256610800b5bd5b5257683df01c019cf339c9b4b4023da

Observation a65a5588-43f4-4ad1-9fd6-eed05ecf2ea5 · outbound

This paper cites Optimistic tree searches for combinatorial black-box optimization.

Policy Guided Tree Search for Enhanced LLM Reasoning Optimistic tree searches for combinatorial black-box optimization

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.755128Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.838967Z digest=sha256:892fa750ee03e9439d7b0bf8c4e3f8c0f9d5d15cefba415ce5f9ba710ef986da

Observation f2e049d4-3b78-4a7d-be61-f12ab04f6682 · outbound

This paper cites Skeleton-of-thought: Prompting llms for efficient parallel generation.

Policy Guided Tree Search for Enhanced LLM Reasoning Skeleton-of-thought: Prompting llms for efficient parallel generation

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.743794Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.842418Z digest=sha256:cac50570d911f526ba7181d7c6fe9cfde9228f74f1a141da95361b6320984c3a

Observation 45588ba6-0ae0-450f-92ae-55e8bd3face8 · outbound

This paper cites Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers.

Policy Guided Tree Search for Enhanced LLM Reasoning Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.845722Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.845722Z digest=sha256:eec01f11bc8e56da75532533b7a9415162cf2a31b935270086e9c673cc7a9b17

Observation 36a6d151-b82f-4be7-b598-15273dcadec1 · outbound

This paper cites Recursive Introspection: Teaching Language Model Agents How to Self-Improve.

Policy Guided Tree Search for Enhanced LLM Reasoning Recursive Introspection: Teaching Language Model Agents How to Self-Improve

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.849766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.849766Z digest=sha256:1329c1a0bf7664032779b17eab200802c17bd463f3b48e05e82f2373c6705235

Observation b87320e4-3764-4a19-a6a9-8a37579481da · outbound

This paper cites P., Luu, A.

Policy Guided Tree Search for Enhanced LLM Reasoning P., Luu, A

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.853543Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.853543Z digest=sha256:68f16f18c9adfd520ece3558a6c1cc741a4b60c09288699e21ba3f903d7cc938

Observation ac371c2a-356a-4ac1-931a-72604fc809f2 · outbound

This paper cites GPQA: A Graduate-Level Google-Proof Q&A Benchmark.

Policy Guided Tree Search for Enhanced LLM Reasoning GPQA: A Graduate-Level Google-Proof Q&A Benchmark

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.856867Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.856867Z digest=sha256:435b60a768f814c61dbff505f2ede6331f5d5d39321e94d6631a24013877fd6e

Observation 7c178857-a19b-40fc-9347-5ef56bc3817f · outbound

This paper cites Language Models Are Greedy Reasoners: A Systematic Formal Analysis of Chain-of-Thought.

Policy Guided Tree Search for Enhanced LLM Reasoning Language Models Are Greedy Reasoners: A Systematic Formal Analysis of Chain-of-Thought

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.860444Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.860444Z digest=sha256:e160a5478fe8fdaf4e313f0c937d300427dfaf8508fd6b9fef92bacc2fa0aa09

Observation cf9e5f39-eaa1-4445-857a-c07289c019aa · outbound

This paper cites Proximal Policy Optimization Algorithms.

Policy Guided Tree Search for Enhanced LLM Reasoning Proximal Policy Optimization Algorithms

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.864048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.864048Z digest=sha256:b4f77857285a3c52234fb90567e8f5c9c024edbb023f37a5c2df1d8915c21eaa

Observation dc58ba97-7b8b-46ee-b3b5-792575f69e19 · outbound

This paper cites Algorithm of Thoughts: Enhancing Exploration of Ideas in Large Language Models.

Policy Guided Tree Search for Enhanced LLM Reasoning Algorithm of Thoughts: Enhancing Exploration of Ideas in Large Language Models

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.867518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.867518Z digest=sha256:4fe96d7f9073ead9a2935c79df175ce225b68db8bd41278572fd9709453a6988

Observation 51fffe79-a280-413d-b851-57e036a9be1b · outbound

This paper cites Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm.

Policy Guided Tree Search for Enhanced LLM Reasoning Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.870961Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.870961Z digest=sha256:24f3b1bd0114304f756383199c01cd311fb57511eea9cf8bd47579f140f5e8e8

Observation 984f8bfb-1d13-4390-9e06-041949791329 · outbound

This paper cites Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models.

Policy Guided Tree Search for Enhanced LLM Reasoning Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.874537Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.874537Z digest=sha256:09afdc41a6a15a7c5b1a7683d2570e38d02ddeb4601bdd69d2f47e5eb3fc49fc

Observation 70267e28-23b8-4550-9c1e-000c7637a123 · outbound

This paper cites Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters.

Policy Guided Tree Search for Enhanced LLM Reasoning Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.878454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.878454Z digest=sha256:94dd446aa40ab72c42568625148bcdc7b0e159995ca835868e25d3d3ee17a176

Observation 3e133e31-c9c4-4849-a627-9515d23e3b3a · outbound

This paper cites On the Self-Verification Limitations of Large Language Models on Reasoning and Planning Tasks.

Policy Guided Tree Search for Enhanced LLM Reasoning On the Self-Verification Limitations of Large Language Models on Reasoning and Planning Tasks

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.881871Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.881871Z digest=sha256:97353e4b433d6291c3523c1975cebca7b999ff3e2ba4548792b50809bcb66267

Observation 04e1a2a4-25e6-4c0b-92c7-ea9851e61490 · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

Policy Guided Tree Search for Enhanced LLM Reasoning Gemini: A Family of Highly Capable Multimodal Models

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.885310Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.885310Z digest=sha256:e6c994785b3cc500f089cf86ab1e331e868d274c6f1bb93b65a888fcbb787fde

Observation 91496b6a-26f4-4be2-983d-56cfc670bc5d · outbound

This paper cites Understanding over-squashing and bottlenecks on graphs via curvature.

Policy Guided Tree Search for Enhanced LLM Reasoning Understanding over-squashing and bottlenecks on graphs via curvature

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.888835Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.888835Z digest=sha256:d3a5e5d4425e2f8fb643226f9209b3936c68a35a8d9ef62c2bf216f36e36f98c

Observation 00791e3b-8eea-40fd-a9aa-0fc4851a3a2a · outbound

This paper cites Solving math word problems with process- and outcome-based feedback.

Policy Guided Tree Search for Enhanced LLM Reasoning Solving math word problems with process- and outcome-based feedback

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.892078Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.892078Z digest=sha256:da854bedf3d5a05a676ff02859bbf6847f047747aedb183f4b090fa3995fd937

Observation 0de27048-ee96-4a40-8899-0bfc5f2ae7a3 · outbound

This paper cites Large language models still can't plan (a benchmark for llms on planning and reasoning about change).

Policy Guided Tree Search for Enhanced LLM Reasoning Large language models still can't plan (a benchmark for llms on planning and reasoning about change)

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.725174Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.895462Z digest=sha256:20afce77f61f4717607c5334c7523e386fdd6bdfecf97b14618c6bba17e5885e

Observation 76cd48da-cc93-4392-b2b0-fee689104cab · outbound

This paper cites Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning.

Policy Guided Tree Search for Enhanced LLM Reasoning Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.898539Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.898539Z digest=sha256:bdd2ec0ba41ef7f54bf588b62d68c1816a342ef85a69bab4bc5b42297613a2f5

Observation 9578d9f2-2921-499e-b562-f4ce9ac9f907 · outbound

This paper cites Learning search space partition for black-box optimization using monte carlo tree search.

Policy Guided Tree Search for Enhanced LLM Reasoning Learning search space partition for black-box optimization using monte carlo tree search

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.714066Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.902029Z digest=sha256:d6fd7ee906115f764c25ef340153e0df54f626679d50b24458c731c5a05675c2

Observation 70ad7418-e212-4c64-9a39-290ae1173e2d · outbound

This paper cites Math-shepherd: Verify and reinforce llms step-by-step without human annotations.

Policy Guided Tree Search for Enhanced LLM Reasoning Math-shepherd: Verify and reinforce llms step-by-step without human annotations

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.703762Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.905513Z digest=sha256:36180d17c40b117d68741027614571e26eae62204a4f4eb211083c851491f575

Observation b6975ffe-006f-4d35-b561-7fe03d7377f8 · outbound

This paper cites Monte Carlo Tree Search based Space Transfer for Black-box Optimization.

Policy Guided Tree Search for Enhanced LLM Reasoning Monte Carlo Tree Search based Space Transfer for Black-box Optimization

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.908661Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.908661Z digest=sha256:723aba568ab16e74217be6ae1b5c05140b59d6f8bf8b65f358abed6abafffa8d

Observation d2e3f5b4-ca17-4bca-aac6-eaf7bf3b7f7f · outbound

This paper cites Self-Consistency Improves Chain of Thought Reasoning in Language Models.

Policy Guided Tree Search for Enhanced LLM Reasoning Self-Consistency Improves Chain of Thought Reasoning in Language Models

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.912088Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.912088Z digest=sha256:90d0921f30970e2be75b64122b511df75a3ad21297dec7033317bbcdc1254728

Observation e9980911-9661-4ee6-875a-c37568ea3d7b · outbound

This paper cites V., Zhou, D., et al.

Policy Guided Tree Search for Enhanced LLM Reasoning V., Zhou, D., et al

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.915463Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.915463Z digest=sha256:24c3ff0b7fd94624b5b1ba3b3d3168293ff4b4a8a6eee52564af795521dcca1c

Observation 59c5bea6-61bf-4867-bfb7-88fed0c17f79 · outbound

This paper cites An empirical analysis of compute-optimal inference for problem-solving with language models.

Policy Guided Tree Search for Enhanced LLM Reasoning An empirical analysis of compute-optimal inference for problem-solving with language models

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.687460Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.918609Z digest=sha256:7c9ca30e24e2e86921c90417eb2976f7f1ae8b53e3879e281b0e52149f782117

Observation 5fb65346-75f3-40e8-8ca6-a85a62814023 · outbound

This paper cites E., and Stoica, I.

Policy Guided Tree Search for Enhanced LLM Reasoning E., and Stoica, I

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.921896Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.921896Z digest=sha256:3cdc351bb6fcb0e3abe41f97a6cdc05b272a1d4ccce2593ecff730a34b7d6191

Observation 54b0c245-e256-405e-8ae9-67f8c9c35f16 · outbound

This paper cites Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning.

Policy Guided Tree Search for Enhanced LLM Reasoning Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.925154Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.925154Z digest=sha256:e5907b2b9235e1f7108d1c2bba2478394ab236b8f0d5fa8131680e9416fb4f8a

Observation 74382a74-53a6-4133-8eea-70071656f3a3 · outbound

This paper cites X., Kan, M.-Y., He, J., and Xie, M.

Policy Guided Tree Search for Enhanced LLM Reasoning X., Kan, M.-Y., He, J., and Xie, M

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.671036Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.928713Z digest=sha256:9adf0c16bfa310161496e426ed04dcdd703932f7c11af0403b930ba3db6e9113

Observation ed060289-a0df-4830-b955-ca663622149f · outbound

This paper cites Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models.

Policy Guided Tree Search for Enhanced LLM Reasoning Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.932348Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.932348Z digest=sha256:0931461a116ca39f73b5b936317b9ff7d37b90164c7d1eb8732d02ca16dc34bf

Observation 6967a217-d91d-4bc0-9904-44b8ed4e6c87 · outbound

This paper cites Tree of thoughts: Deliberate problem solving with large language models.

Policy Guided Tree Search for Enhanced LLM Reasoning Tree of thoughts: Deliberate problem solving with large language models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.935906Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.935906Z digest=sha256:c71e6fde4e12eab70c8081c8ca3efbe7a0dd4a890a0ef84cbd8d31975420d8a8

Observation 176ca526-b4e5-407d-b01a-254519327832 · outbound

This paper cites Do transformers really perform badly for graph representation? Advances in neural information processing systems, 34: 0 28877--28888, 2021.

Policy Guided Tree Search for Enhanced LLM Reasoning Do transformers really perform badly for graph representation? Advances in neural information processing systems, 34: 0 28877--28888, 2021

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.939353Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.939353Z digest=sha256:5c2049d495cfc15654bb15bdcdc5ac758767395ee0bc3596aedb9d3ea5a84b36

Observation cfa470f6-c27c-4f23-a3f3-b733823087db · outbound

This paper cites Scaling Relationship on Learning Mathematical Reasoning with Large Language Models.

Policy Guided Tree Search for Enhanced LLM Reasoning Scaling Relationship on Learning Mathematical Reasoning with Large Language Models

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.942681Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.942681Z digest=sha256:e6db0827f59e2c800cd325493269de5c463ce36e781eabcfaf327512018a3ca1

Observation 5ea26b77-66fd-4983-8764-58dfa8264b06 · outbound

This paper cites Star: Bootstrapping reasoning with reasoning.

Policy Guided Tree Search for Enhanced LLM Reasoning Star: Bootstrapping reasoning with reasoning

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.946092Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.946092Z digest=sha256:1cb5f77062299872462c921a93f0bae3b1984edcc3fb5cf9c2f718cfbe467981

Observation abaf1b98-c8b5-43c9-9b3d-d279852df8cd · outbound

This paper cites Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking.

Policy Guided Tree Search for Enhanced LLM Reasoning Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.949922Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.949922Z digest=sha256:455cd79e45b4ae9bcc10bd4093dbc36c45eadcbab8536c0f025338d0d7500845

Observation a64589d9-e0ca-4da1-a245-07214d3ec100 · outbound

This paper cites and Gao, S.

Policy Guided Tree Search for Enhanced LLM Reasoning and Gao, S

Reference 72

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T11:20:32.642416Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-09T11:20:31.953546Z digest=sha256:48db865a35bc8044fe044a68b64f9d2547031473e67e8774b1ec5cda75972530

Observation 958edd1b-4014-4ef3-9bd3-e318dce674e2 · outbound

This paper cites Generative Verifiers: Reward Modeling as Next-Token Prediction.

Policy Guided Tree Search for Enhanced LLM Reasoning Generative Verifiers: Reward Modeling as Next-Token Prediction

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.956829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.956829Z digest=sha256:8afc18d9dce20ac6cdaa5f70dc150c5ad7c82f19eb8f3ec11b4f7160268d4c56

Observation b0fea989-6671-4fb9-8803-db527ecd73f6 · outbound

This paper cites Automatic Chain of Thought Prompting in Large Language Models.

Policy Guided Tree Search for Enhanced LLM Reasoning Automatic Chain of Thought Prompting in Large Language Models

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.960855Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.960855Z digest=sha256:a9bf50a87f21e354f8350872fb037c6b9981267569209497b700ff32f95cbd04

Observation fbf46d1e-1e33-42d2-bdfd-ae37ef5f27fe · outbound

This paper cites Verify-and-Edit: A Knowledge-Enhanced Chain-of-Thought Framework.

Policy Guided Tree Search for Enhanced LLM Reasoning Verify-and-Edit: A Knowledge-Enhanced Chain-of-Thought Framework

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.964267Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.964267Z digest=sha256:dd75589bf7fb56a66ffa6357ae034fba5eaafc7c029ed406efe861ec34e6a16d

Observation 869d8319-b006-4919-be74-e3315e0e7c52 · outbound

This paper cites Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions.

Policy Guided Tree Search for Enhanced LLM Reasoning Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.967745Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.967745Z digest=sha256:cd16b8eefc128c8aae69b26697647fe9cfa13ca6187f6ed69e5932d955ed4931

Observation b8f4a539-3f95-4c88-9c3c-265b6d2536ab · outbound

This paper cites Least-to-Most Prompting Enables Complex Reasoning in Large Language Models.

Policy Guided Tree Search for Enhanced LLM Reasoning Least-to-Most Prompting Enables Complex Reasoning in Large Language Models

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-09T11:20:31.971505Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:20:31.971505Z digest=sha256:97660439c5cc1643836dd5390e3ccf0b641e4e0bfcdcea6d46a845cb5bbcf28c

Pith citing papers

Observation 52916082-75b5-40ba-a7ea-def69baa47a2 · inbound

AlphaMemo: Structured Search-Process Memory for Self-Evolving Alpha Mining Agents cites this paper.

AlphaMemo: Structured Search-Process Memory for Self-Evolving Alpha Mining Agents Policy Guided Tree Search for Enhanced LLM Reasoning

Reference 25

Resolution
metadata mismatch
arxiv_id, observed 2026-06-29T17:03:41.292335Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-06-29T16:55:21.649886Z digest=sha256:5f81908dc3f928fa06c111f1b62527db05574990efa93ea5afca48bb80c4d769

Observation 44ac1250-0ed4-47c0-867f-4b945ac0f73c · inbound

Efficient and Trainable Language Model Test-Time Scaling via Local Branch Routing cites this paper.

Efficient and Trainable Language Model Test-Time Scaling via Local Branch Routing Policy Guided Tree Search for Enhanced LLM Reasoning

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:20:06.692526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-06-25T21:29:40.564852Z digest=sha256:0e9d6e6c4e9864e634483f4595a9a43635a6074df0fdfd6aa8a4cfb0c3f71ff7

Observation 16ab1b89-1f16-401a-a9c0-beb8ccc4eebc · inbound

Efficient and Trainable Language Model Test-Time Scaling via Local Branch Routing cites this paper.

Efficient and Trainable Language Model Test-Time Scaling via Local Branch Routing Policy Guided Tree Search for Enhanced LLM Reasoning

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-07-01T06:35:29.610925Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-07-01T06:33:45.824727Z digest=sha256:349d72aefe9b159710f5b239769cd55333d1a7863ae9a22c2138b77fde406f0f

Observation 2ecb3394-cd05-4048-a1aa-f79a237b0754 · inbound

MILES: Modular Instruction Memory with Learnable Selection for Self-Improving LLM Reasoning cites this paper.

MILES: Modular Instruction Memory with Learnable Selection for Self-Improving LLM Reasoning Policy Guided Tree Search for Enhanced LLM Reasoning

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-07-09T00:45:49.124174Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-07-09T00:45:00.847714Z digest=sha256:46c352b183ddcc522fcb1ec1425783e0b110566af67955a42954a8d0729e7708