Pith. sign in

Paper Citation Record · LEDGER

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

As of 18 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 11 inbound Pith citation observations for arXiv:2412.15797.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.15797 v1

Coverage vector

measured 56 of 56 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T11:08:56.611535Z

measured 67 of 67 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00

measured 11 of 11 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T00:47:59.894438Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T05:57:41.442502Z

Reference resolution

56 of 56 outbound references displayed

  • verified exact2
  • verified fuzzy1
  • unresolved53
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 83649f6d-5ac7-4325-9395-55417363b19d · outbound

This paper cites online" 'onlinestring :=.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning online" 'onlinestring :=

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.274552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.274552Z digest=sha256:e9939072b017c071e3715edee029b2d4496b5fdd4e1066d1f55577ee9fff26bc

Observation 63a3deb9-b5d7-4bba-a982-422c23cc3607 · outbound

This paper cites write newline.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning write newline

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.282190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.282190Z digest=sha256:3da57965301b29c54d31275ea8cae522672f8e22c79d59f1b000ff9506e9f99b

Observation 6c9365ac-b786-43bb-9624-242f30080731 · outbound

This paper cites MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.288180Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.288180Z digest=sha256:e4b3c94ae7f568af5b3231b07078110367f127ca3a3718b712660812e4a6d95c

Observation c4fdce8b-450c-4449-a7a2-b6d2a889a2ff · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.295254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.295254Z digest=sha256:03e14b7a9fdfef5d20021e0c5c908d47985c764207ea48ffd0e8ebc2e1d14ba3

Observation 0029b63b-d190-4d84-87e0-cd0f3667bfc0 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.302585Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.302585Z digest=sha256:edc8463a143c5778e78bb0da3a851f91ffe13774bf2bfbed4e1bec8a29b6860d

Observation 7480710a-0c1d-4eed-8c5f-1905ec51d4ff · outbound

This paper cites Browne, Edward Powley, Daniel Whitehouse, Simon M.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Browne, Edward Powley, Daniel Whitehouse, Simon M

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.309437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.309437Z digest=sha256:2e62d7b4ceb8e7e7fe6d3e0171ea0e97fb4ed9a2f7a6c81eff2e5a8e33e932d5

Observation 72edda3f-c1b9-419c-8216-4b3ca09c3617 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.315488Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.315488Z digest=sha256:91d09c2e80f323127b9f2c1d532d4e1cc3f10be82167ee7bd9af8647f4c71d83

Observation 931f9888-7e59-488d-872c-17923603353d · outbound

This paper cites Scaling Instruction-Finetuned Language Models.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Scaling Instruction-Finetuned Language Models

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.322577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.322577Z digest=sha256:21524a0038035de5510855de83159d1415410d917d2bd9a1ca743391d94c8328

Observation 5593f14b-4e65-4ee8-8af9-f2b44691fc64 · outbound

This paper cites Training Verifiers to Solve Math Word Problems.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Training Verifiers to Solve Math Word Problems

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.329421Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.329421Z digest=sha256:aee14fe2f2b4343c4fcd9fc3f4b1f4c6b9ac2e33adba754ac7f89118b059026a

Observation 6b929652-35c8-4b15-a8d3-98215fc105dd · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.334759Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.334759Z digest=sha256:0556478b576739550359ce808c1d563c6f4c56161f3684bff6bdc524a6e7ea32

Observation cab89d98-62c3-42a8-a019-0af645b7f405 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-11T11:08:57.826440Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.339476Z digest=sha256:05a0197947d33a6578d8937f24c52542645231e4b6ce4a950e2f728b5eb49b73

Observation b9dd771f-8ff7-4182-846e-e8995256f68d · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-11T11:08:57.801407Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.345247Z digest=sha256:110985a04b79eaa8f10d747a486702c85f246ca9f318e52f019705a8b64b3429

Observation ee097a1a-c3b6-468a-bd41-a823ce98bed9 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 13

Resolution
verified exact
doi, observed 2026-08-11T11:08:56.834490Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.350974Z digest=sha256:0c27329e5b8b0cc3a2a4059a7bbda5af90c055a1d2a22525fc8e56f350c360a5

Observation a0b38c5f-97f0-465f-bf7b-bfe49f0da580 · outbound

This paper cites Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.359209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.359209Z digest=sha256:45277ee0a9f3553abc9fc8de3a25df4cab0b3192ef85e392adcda863275ec55c

Observation 0265996a-e497-4fc9-9da5-9089ac9020ec · outbound

This paper cites Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.365319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.365319Z digest=sha256:b72f3a293f3b6b2385395ee506d5be1868a39419cf910d620a215876ca91f458

Observation dc481100-adc9-4fc2-aa14-c3b2de9b3fea · outbound

This paper cites Gemma 2: Improving Open Language Models at a Practical Size.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Gemma 2: Improving Open Language Models at a Practical Size

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.370865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.370865Z digest=sha256:ec4d6241c1062ef997758e061e013a5de1c14b7c6a91f90d961241ce8bd9b8d1

Observation 74fdfcf5-a2ac-4d3d-b846-5fc7691b9047 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-11T11:08:57.781601Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.376286Z digest=sha256:8375f8be89a393bea49898bfdb6bec96d2e9007478c5e3d1924df6de782fbd7f

Observation 5252f4e0-a6f9-4450-8b6a-2ba7bc061dd4 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.382188Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.382188Z digest=sha256:c48306f465a2adae8a40daf53d468e07452809d8f9e68ecfb67320fcc1d96024

Observation e35aa3cf-df9f-43e9-b29a-0e6f1e071204 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.387453Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.387453Z digest=sha256:297bb475c9bef96265387eb54960c08d35d88c212e37361a84c9fbd395631a14

Observation f235046e-a80c-4825-b9f6-9d076534daec · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.393504Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.393504Z digest=sha256:311c6490ba0568527bf128aba3039418b7060db417f191ef3bb107ed2b6ac3b6

Observation d53cf3aa-b6b8-49b6-8b95-3efe1601034d · outbound

This paper cites Mistral 7B.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Mistral 7B

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.398987Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.398987Z digest=sha256:f0409f28b64b17232b12d4d65954050fe43fece87d5deb088b26394864e191d0

Observation 58acc187-460d-438f-9eca-aeab407ce5e8 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.404167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.404167Z digest=sha256:95ed485cca9682c90a07449deb43013c8190b1b1063418a9c8b7074feef10cb5

Observation 71cf61c0-d039-4e99-9bc1-d8823bd21016 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-11T11:08:57.727204Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.409541Z digest=sha256:7d9bd6f062c97d98f53d73fdcf9064d94483191573b9438b1b45614f713135ae

Observation 462aadfd-c8f3-4a5f-8d2a-cd144695483d · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.415238Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.415238Z digest=sha256:853e9da705ec6850adac601b318c70462f43c46fff1e497ba53c4d3cf68ec827

Observation f936d18d-dbe3-4c4b-91cd-a835713d27dd · outbound

This paper cites Purifying Large Language Models by Ensembling a Small Language Model.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Purifying Large Language Models by Ensembling a Small Language Model

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.420484Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.420484Z digest=sha256:4696071fd9563d578d353ebe3931a290a0ca857ba94783650274680f1684146b

Observation 6b97e396-e858-4cf7-a96c-8d79c0bff999 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.425662Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.425662Z digest=sha256:3126d1631f9b59429e27793bda600497afc4e0d2a0beeca3dd5dd3f6f742bfa0

Observation 476fdd33-49ea-4dd9-99b1-b8ca14cbdbe0 · outbound

This paper cites Let's Verify Step by Step.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Let's Verify Step by Step

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.430501Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.430501Z digest=sha256:ee1bc4ddd2cba26ff0b1cc0a3eb4fb62cc5a5db7f5d21126fba9d395e7b5e40a

Observation a71cdda9-fcea-456d-8052-028a1eb6b756 · outbound

This paper cites Rho-1: Not All Tokens Are What You Need.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Rho-1: Not All Tokens Are What You Need

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.441600Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.441600Z digest=sha256:8e86bef78087048121daa12bb981d128d51850652a4454bfeaecbdebb47dfdf6

Observation 4de7ff82-6882-4666-bb5c-8668388d7ce5 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.447540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.447540Z digest=sha256:0a080637325918e9f7c4d7600cb0baef27b1cd168ae1a16963bba347c42748b5

Observation 41ebfd6e-55d1-4d26-aa73-a81c4ff590db · outbound

This paper cites Tuning Language Models by Proxy.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Tuning Language Models by Proxy

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.453684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.453684Z digest=sha256:6238d206a469b091100262e94470044fc4a26abfc163deb69f232e549ec50d0e

Observation 3ec8f8b4-f4a9-47dd-9741-991016f64065 · outbound

This paper cites Smith, and Yejin Choi.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Smith, and Yejin Choi

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.458580Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.458580Z digest=sha256:648eee23b7c7d72701375fdc366ca4034fa9470bc0230b0627ad53753f44534b

Observation f14a627f-2ffa-4ebd-8f69-a74561287010 · outbound

This paper cites Cool-Fusion: Fuse Large Language Models without Training.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Cool-Fusion: Fuse Large Language Models without Training

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.464820Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.464820Z digest=sha256:98794fbaead664b88e8c94da3ab013d4c54f627dab8eb3ac41293bfc26a31c16

Observation 69d1a5ed-6dbb-499f-b897-543148cf472c · outbound

This paper cites The Llama 3 Herd of Models.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning The Llama 3 Herd of Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.471500Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.471500Z digest=sha256:71e598282948130d0a4c44a9b1572a20026e18b90e2519f514be5742ca319d3b

Observation 2db5d6dc-f1c6-4f09-b1be-a2243743930a · outbound

This paper cites AutoPSV: Automated Process-Supervised Verifier.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning AutoPSV: Automated Process-Supervised Verifier

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.477557Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.477557Z digest=sha256:20ba7f95ca76d1e62c4b5a44a3befd62bb6e637471e227db739092afa4851222

Observation 859a9c5f-6519-4f6b-b9a7-6c872ae85158 · outbound

This paper cites Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.488571Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.488571Z digest=sha256:ee9e3a918947a7dc02881e59a576cfe7f13cabb7af75f6ac90e9f578b26cca89

Observation 35920f6d-085b-4ac8-8302-972bc501cf93 · outbound

This paper cites Let's reward step by step: Step-Level reward model as the Navigators for Reasoning.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Let's reward step by step: Step-Level reward model as the Navigators for Reasoning

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.494912Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.494912Z digest=sha256:3d5e099c74645f005932f51468295b53d8dcd8dac7c50a55d2786c6088cf80e8

Observation 539834a3-0c29-4dd3-80d9-d4af80784acb · outbound

This paper cites Pack of LLMs: Model Fusion at Test-Time via Perplexity Optimization.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Pack of LLMs: Model Fusion at Test-Time via Perplexity Optimization

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.500680Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.500680Z digest=sha256:5b7139cde38b12881843c37521f11794ff211f2d09f2c897cc80bfc112e7e31f

Observation c9a6acc0-3e2a-4ef2-84b5-771348c0354c · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.506056Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.506056Z digest=sha256:785589ed2616140fafe1c0ec6025427d47489a6eeed2ff129bec1647cb761c43

Observation be8da720-04fa-42c9-baae-18239474d660 · outbound

This paper cites GPT-4 Technical Report.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning GPT-4 Technical Report

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.510796Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.510796Z digest=sha256:8e217f87de699b2b2e398faae66cfb36602e7206c203f3e51b03278a59ffec8a

Observation 30f35450-dbfe-4a3e-aeaa-20008170b05d · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.515750Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.515750Z digest=sha256:fb69c1cc6f3cc86cd0d44cc750c0938633ad11665b7126fa7ce925e4a3e34580

Observation 1a713309-4c8f-4e09-b4bd-f765a1eedde5 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 41

Resolution
verified exact
doi, observed 2026-08-11T11:08:56.719730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.522381Z digest=sha256:424590b82b685f18df66023e8ed1da12f1bf61f677cb246f6102f55cf4f95648

Observation ced31871-6cf7-456a-b618-710f1b2916c8 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.528237Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.528237Z digest=sha256:378074643cd297010816792553dae155e82d637efe41cbb57782a7387e1c6c08

Observation 5ca98572-cd7b-402e-832b-2556fcb4081e · outbound

This paper cites Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.533394Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.533394Z digest=sha256:88f3beb521d6e484d5c69312e693b25c7ed86b3ca0b6281a1054c65c8b7ccd66

Observation dc66aa25-a334-4017-8499-1d0fe107433b · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.540260Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.540260Z digest=sha256:dad0cbbc6c8cd106979774e6a3c8d8ba97ab01f372feb981e6acb9290acbde94

Observation 094332c2-7e9e-468a-8f4e-1802dfe04099 · outbound

This paper cites Solving math word problems with process- and outcome-based feedback.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Solving math word problems with process- and outcome-based feedback

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.546298Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.546298Z digest=sha256:fbf515ae3a6a264ec91b2c353364bb8b09a0a9a72591d77b22ce94721a2175ab

Observation 32919e71-085d-4b20-b205-e71279e046b8 · outbound

This paper cites Mixture-of-Agents Enhances Large Language Model Capabilities.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Mixture-of-Agents Enhances Large Language Model Capabilities

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.552915Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.552915Z digest=sha256:b91109cdb1e28813e8635d17d53a642b3709212f09572516689e22e147f4a728

Observation 7035f7a5-ae00-40c9-a13a-01a35b467010 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.558412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.558412Z digest=sha256:5c6fc68366b16aea6d2e505e6995e0cb131033542d6cced1b98eeb42c65a18d3

Observation cc36740a-0ee8-476c-9372-6b1ef3bf9cc8 · outbound

This paper cites Le, Ed H.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Le, Ed H

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T11:08:57.676137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.563587Z digest=sha256:2f322b723d866866c9475dfa09b11a63b7624530fb615e15fe025efc93ebf201

Observation 7f5e37b2-3a76-45cf-b343-7d67e78b9abf · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 49

Resolution
unresolved
raw_fallback, observed 2026-08-11T11:08:57.656710Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.570203Z digest=sha256:68b20252e8ed413a8dfcc98efc363c171f1a366966749654d0a609e86845f116

Observation 9602b1f3-a54b-4b76-a174-904b8153bf66 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 50

Resolution
unresolved
raw_fallback, observed 2026-08-11T11:08:57.638552Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-11T11:08:56.575437Z digest=sha256:721933347aef4161d33d7ded7cf9307579c1c6dffb498215a8701e9813569955

Observation 951855e9-4ce1-4898-9d3b-e1222f87e4d7 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.581281Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.581281Z digest=sha256:5e3794953dd6048a99447fdf2fb290c651a0c9e7577f794ac4c96a0589d2953a

Observation fef0a5a4-dc57-4ca4-a33b-b23166ea1edd · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.587267Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.587267Z digest=sha256:7869ef5660ad1bafbf80ee809fced9625b2118d4a5bef65fc26c8417ef383c4f

Observation f5db6909-6e59-4dfe-b80c-b787840c9f61 · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.593604Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.593604Z digest=sha256:d77da49556ac54621e7a166cf4d476f9708f27e5c527fe665de20aa0a033086f

Observation 50c1f99a-0b11-47d1-ad39-7115053fa1fb · outbound

This paper cites an unresolved cited work.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Unresolved cited work

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.600003Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.600003Z digest=sha256:f120932bf52d659fe108a029e6bdb4efc5e56a4d68f607830a83ff8c5173be3e

Observation 97a7ba7b-0c46-4a77-a28d-a9dfa12f5b1e · outbound

This paper cites Scaling Relationship on Learning Mathematical Reasoning with Large Language Models.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning Scaling Relationship on Learning Mathematical Reasoning with Large Language Models

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.605782Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.605782Z digest=sha256:13c6ee4719652010c2b7671824e9f15304db4426294ea6013f437b9e6685df0b

Observation 7bdef6c5-b27f-42c2-b52d-610c5aedda5b · outbound

This paper cites ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search.

Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-11T11:08:56.611535Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T11:08:56.611535Z digest=sha256:c01a08752499311f7a3ed447e46222bd26bcd340c1af3d0cbfd67342adb8f610

Pith citing papers

Observation fd3df95f-703c-4ee3-901a-8ba0f8685769 · inbound

Bridging Internal Probability and Self-Consistency for Effective and Efficient LLM Reasoning cites this paper.

Bridging Internal Probability and Self-Consistency for Effective and Efficient LLM Reasoning Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-09T18:53:44.219142Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:53:44.219142Z digest=sha256:3d735d769eaa2ba2e5b0ccf68427cc97790b4b10fa17bd525a54629a236baa32

Observation 364b56a7-d41d-4973-9c34-1f70ed6a6dc3 · inbound

Harnessing Multiple Large Language Models: A Survey on LLM Ensemble cites this paper.

Harnessing Multiple Large Language Models: A Survey on LLM Ensemble Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-23T02:25:19.659071Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-05-23T02:22:28.649071Z digest=sha256:ba17694b3a5682e16404a19fa3cd53bbc0c04088454ed14fe12f14ccad8ec4c4

Observation 1ca95a0f-f308-4e95-a3d5-653fc7fefe31 · inbound

Sailing by the Stars: A Survey on Reward Models and Learning Strategies for Learning from Rewards cites this paper.

Sailing by the Stars: A Survey on Reward Models and Learning Strategies for Learning from Rewards Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T00:47:59.894438Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:47:59.894438Z digest=sha256:f1a86e27509759dc3499fdc556eb312cbaeab7ab227580b81d1a14162d3dd328

Observation 326fe5bc-3c46-494f-8c9c-400f7d0fc181 · inbound

Beyond the First Error: Process Reward Models for Reflective Mathematical Reasoning cites this paper.

Beyond the First Error: Process Reward Models for Reflective Mathematical Reasoning Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T15:38:48.422552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:38:48.422552Z digest=sha256:84939df8264462d11b41a5997685e6efeed8462e5d598f0203517ef1266cfd02

Observation 232eaefc-3bc4-4bad-b615-876ba2ba4022 · inbound

Evaluation of LLMs for mathematical problem solving cites this paper.

Evaluation of LLMs for mathematical problem solving Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 101

Resolution
unresolved
no resolver link, observed 2026-08-07T12:11:10.351445Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:11:10.351445Z digest=sha256:6a26d19eafc5189a6ce449ab5fdd24f4f4cad0d41aeb714e9a3b1bb0f807e10c

Observation e72261ed-8f67-4ffe-93ac-33156ce75bb4 · inbound

GEMMAS: Graph-based Evaluation Metrics for Multi Agent Systems cites this paper.

GEMMAS: Graph-based Evaluation Metrics for Multi Agent Systems Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T16:32:46.143917Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T16:32:46.143917Z digest=sha256:070d1b68bf635d1a22c91f71fc74b9677ec1c4781d321f8b0e3d19a65a4decf0

Observation 96e80361-5fc2-444b-a199-df603dc99626 · inbound

Simultaneous Multi-objective Alignment Across Verifiable and Non-verifiable Rewards cites this paper.

Simultaneous Multi-objective Alignment Across Verifiable and Non-verifiable Rewards Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-04T13:15:46.204310Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T13:15:46.204310Z digest=sha256:56b92bb52d06c8fa177b7564b0949255996992295c69371e50217dfa87ee0eed

Observation 5653e0b5-ed2c-489b-b68f-c60db92684e9 · inbound

Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models cites this paper.

Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-18T09:56:13.080196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-05-18T09:53:57.765473Z digest=sha256:25037d2cc71e3a30d750c6688aa24d25ed78fccec4f84253dd6be7f8cb6f1614

Observation a30c07b4-60c7-4ddf-bf77-59ca8f5e8d95 · inbound

Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-Review Process cites this paper.

Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-Review Process Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 40

Resolution
verified exact
arxiv_id, observed 2026-05-16T19:58:22.734835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-05-16T19:57:03.999154Z digest=sha256:c5fdcbe642ea1768443e3a7f8a5b0f1b27bb4a4a63111a33ffef07bfb21c070c

Observation 4eb27ee2-b77a-4992-867f-13ebc755be51 · inbound

The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes cites this paper.

The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 187

Resolution
verified exact
arxiv_id, observed 2026-07-03T05:57:41.444027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-06-27T12:59:51.091008Z digest=sha256:a6a5d860cea3fc99c9ceecbed946133f930a7e9859856156bdb019dd08c6f951

Observation f764fec9-15e5-4f06-964e-85092081977f · inbound

TsuGO: Probing Search Efficiency in LLM Reasoning via Go Life-and-Death Problems cites this paper.

TsuGO: Probing Search Efficiency in LLM Reasoning via Go Life-and-Death Problems Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-14T15:59:25.460821Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T15:59:25.460821Z digest=sha256:885e42a9242d646eff54143dfc29a9ad6164732644b1313b3fedc1e65b465e79