Pith. sign in

Paper Citation Record · LEDGER

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance

As of 12 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 0 inbound Pith citation observations for arXiv:2605.22567.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2605.22567 v1

Coverage vector

measured 83 of 83 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-11T11:50:26.030339Z

measured 83 of 83 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

83 of 83 outbound references displayed

  • verified exact45
  • verified fuzzy21
  • unresolved3
  • parse uncertain1
  • malformed identifier0
  • metadata mismatch13

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 5bae1058-3cc9-4b12-94b0-af4fa8223685 · outbound

This paper cites Advances in neural information processing systems , volume=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Advances in neural information processing systems , volume=

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.529799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:0289a94c12556f3954cba5c60da9f84595276e1942113bbf1c851fe22ce0fbc9

Observation 3bf6452e-08eb-467b-b33a-0cd7d666021a · outbound

This paper cites an unresolved cited work.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-05-22T06:21:11.509632Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:a09872c2a3a73e9810febd72059813f38146429a612dc43ca0b547c074184b70

Observation 6ee4a7c3-c25b-4d02-9cd6-d64d2ba24e7d · outbound

This paper cites Linjuan Wu, Hao-Ran Wei, Jialong Tang, Shuang Luo, Baosong Yang, Fei Huang, Yongliang Shen, Weiming Lu.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Linjuan Wu, Hao-Ran Wei, Jialong Tang, Shuang Luo, Baosong Yang, Fei Huang, Yongliang Shen, Weiming Lu

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.576028Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:3097790242a7b60e19359b11cbf6a20682909a2227539f584492f1dd22f2fb1c

Observation b8dbf2a1-6ea5-439a-be72-65acad0a72cb · outbound

This paper cites author Feng, Y.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance author Feng, Y

Reference 4

Resolution
metadata mismatch
doi, observed 2026-05-22T06:21:09.664647Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:611d9ccf1c634c92daa169f77954ccff15173d56a2d5920beccc8426eeb01255

Observation d1e0b85b-49dd-4146-91c6-acddfbf6890b · outbound

This paper cites arXiv preprint arXiv:2603.04597 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2603.04597 , year=

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.288365Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:edbb6283bc7b14fca1a8ff02cf3e41c301030352eb5c750d1e034505ba7a2955

Observation 2b6cd2a7-4e11-41c1-bcfc-6ec30de4e053 · outbound

This paper cites Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models

Reference 6

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.570764Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:57fd31de8e6bee7a05fa08f897f5aa90a72174b20047f2c5d4bf2e84a51f94f5

Observation 9335aab5-fd03-402d-87e2-93709a5939e1 · outbound

This paper cites SLAM : Towards Efficient Multilingual Reasoning via Selective Language Alignment.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance SLAM : Towards Efficient Multilingual Reasoning via Selective Language Alignment

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.588074Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:97ee7be84262d3ab3786c8319ce5f5f57b21c3c00584ab2ba04058eab5bf2136

Observation 7503c952-5389-4ac6-8628-beba2da63df0 · outbound

This paper cites arXiv preprint arXiv:2603.19097 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2603.19097 , year=

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.358940Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:f6048ab795e5fd8c720c2f02d08561b8039bdd35275f71b20055ad08c19ac2e8

Observation ec387173-3331-4db6-be7a-7e341ab79c9e · outbound

This paper cites The State and Fate of Linguistic Diversity and Inclusion in the NLP World.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance The State and Fate of Linguistic Diversity and Inclusion in the NLP World

Reference 9

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.675547Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:6bab4570f235a7587fd2ebf7813fdbdb951f89c2caaaecfffed49757d65fb608

Observation 9840533d-2457-4aa3-a52d-24c48e4aa7bf · outbound

This paper cites First Conference on Language Modeling , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance First Conference on Language Modeling , year=

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.596511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:755fd5008e4b3c479b4ad9bef8e271783f83a0ca7f4f3db7d7a7eed04c2550cb

Observation 4a0c7831-f9bd-48cf-8e11-4ec8bc526bf0 · outbound

This paper cites Proceedings of the AAAI Conference on Artificial Intelligence , author=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Proceedings of the AAAI Conference on Artificial Intelligence , author=

Reference 11

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.539145Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:df82908b21f071c363aed1b98a81deaabac563e932c4b6760d5d312717034bec

Observation 30689f68-2d9f-4fe7-981c-5de38d68dd74 · outbound

This paper cites Crosslingual Reasoning through Test-Time Scaling.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Crosslingual Reasoning through Test-Time Scaling

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:09.735534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:299a79a4427978b74b5c0018a8c7562b8de11bb0d3d6effd4f6093a95d772db0

Observation 3535989b-63c8-41f7-9c24-184949ddf50b · outbound

This paper cites Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning

Reference 13

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:10.322563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:5f144bc9e0b43e0d38bb21620d6506b0cbb9bd602d30421e358f8aa8fe0aa613

Observation 2ef391bd-b367-4118-9c1d-a0d3a37edb50 · outbound

This paper cites Language Mixing in Reasoning Language Models: Patterns, Impact, and Internal Causes.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Language Mixing in Reasoning Language Models: Patterns, Impact, and Internal Causes

Reference 14

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.643169Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:9df34c8026c19d9354237c4ed87c0469b00d54874bfe939748086ba64ecdab50

Observation 436603ab-cb2a-4bfa-af7d-ad303dec3d7e · outbound

This paper cites Is LLM an Overconfident Judge? Unveiling the Capabilities of LLM s in Detecting Offensive Language with Annotation Disagreement.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Is LLM an Overconfident Judge? Unveiling the Capabilities of LLM s in Detecting Offensive Language with Annotation Disagreement

Reference 15

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.626079Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:1972d8f20a2a3f58aee5fecf229b347bed34a792d8ec9eb6862d2510d6ba7b66

Observation cc2b17b6-010c-44c9-bdc5-147dc4987fb9 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 16

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:09.564669Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:8033e4535d046f5abde5f93eb1a038ac90dc3eccf8b7faf35d855e01ae481ea5

Observation 9953abc3-9f37-45cc-ae1a-ad8445afdabe · outbound

This paper cites arXiv preprint arXiv:2504.18428 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2504.18428 , year=

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.353284Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:4fbf6106a074853b3f74cc841cf3a8ef3c579823acd0ba3010a485ec8e7d4cd0

Observation 1a3dde83-27e3-4fc0-a356-cef691412fc4 · outbound

This paper cites MMATH : A Multilingual Benchmark for Mathematical Reasoning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance MMATH : A Multilingual Benchmark for Mathematical Reasoning

Reference 18

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.704310Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:d87f03bafb0e11108394c74b958b8857dabdddcd49669d0f2331f8c384607a5f

Observation 33ec0069-9e7e-4184-b0a1-941996780236 · outbound

This paper cites When Models Reason in Your Language: Controlling Thinking Language Comes at the Cost of Accuracy.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance When Models Reason in Your Language: Controlling Thinking Language Comes at the Cost of Accuracy

Reference 19

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.684054Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:998d2e65dc81b159eb837f88fa1a83237afba3483466b52b34471d4581894ffc

Observation f37eed6b-c595-4646-9f36-97379e886015 · outbound

This paper cites Multilingual Test-Time Scaling via Initial Thought Transfer.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Multilingual Test-Time Scaling via Initial Thought Transfer

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.394898Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:c9978ad7b2c43b5cbb09678b8d8fe3d8d78b707ea709f877f421d5939a9abc60

Observation f39d86af-1277-411f-bba2-62e51deb5309 · outbound

This paper cites arXiv preprint arXiv:2507.05418 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2507.05418 , year=

Reference 21

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.389125Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:fed8eb45c2e042c6b6e5c211163f3c7d6b7703f2b97b82f48aad7e6b2e88f34c

Observation 5ec0a21a-04a2-4143-9f15-a7cfd43cd343 · outbound

This paper cites arXiv preprint arXiv:2506.05850 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2506.05850 , year=

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.400852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:06d8c7c455cf2f54287a40bc4a0cc2fc0c7d2b94475a1b066c77ead3ab27e6aa

Observation 9ab76d68-14be-492e-9f8a-fb775ea418be · outbound

This paper cites arXiv preprint arXiv:2510.07300 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2510.07300 , year=

Reference 23

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.370544Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:a91a68bd2ae7c2fa798c00abaf6d38df1844e208d870ab9e709e68c4df144d5a

Observation eef01423-0a90-4078-ae3c-95505687db18 · outbound

This paper cites arXiv preprint arXiv:2510.02272 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2510.02272 , year=

Reference 24

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.418963Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:8f72078cbffee051e4b67e5603fd495afdc4e59d9ee3952fdbd34373307bc90c

Observation 33edb356-7d2c-4636-ab08-b5cc52b0963d · outbound

This paper cites Efficient Reinforcement Finetuning via Adaptive Curriculum Learning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Efficient Reinforcement Finetuning via Adaptive Curriculum Learning

Reference 25

Resolution
metadata mismatch
arxiv_id, observed 2026-06-23T03:13:10.410609Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:650ef46feab899c95f6ca798a081487c31fcd88237375559ffb304407c7d49f5

Observation 9ab7fb25-0ce4-449e-b178-1a2e6f78d139 · outbound

This paper cites Don't Tell the Answer, Truly Guide the Reasoning During RL Rollouts.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Don't Tell the Answer, Truly Guide the Reasoning During RL Rollouts

Reference 26

Resolution
verified exact
arxiv_id, observed 2026-06-23T04:13:40.575864Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:1be0d845c9b8afe8c3675c08a64e19cd305603b02b97823387a2d61b058a43fa

Observation 23f61bfc-1d93-4359-bfc2-29a17a5582dd · outbound

This paper cites F ast C u RL : Curriculum Reinforcement Learning with Stage-wise Context Scaling for Efficient Training R1-like Reasoning Models.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance F ast C u RL : Curriculum Reinforcement Learning with Stage-wise Context Scaling for Efficient Training R1-like Reasoning Models

Reference 27

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.631137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:8827d1a4ad03f89d9b645087cd8f8b25db1df5fbb5dc70a46baa71f4e02febf7

Observation a78a41be-ffcf-42fa-a9a9-8721c63cc08b · outbound

This paper cites arXiv preprint arXiv:2507.13266 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2507.13266 , year=

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.317325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:dc972a99306ce4c37abad339997d05784a6e84ba7a112c4466a775d36fc15f62

Observation 191902fe-f9b7-457f-a8ab-53c5cf24bd31 · outbound

This paper cites Understanding the Repeat Curse in Large Language Models from a Feature Perspective.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Understanding the Repeat Curse in Large Language Models from a Feature Perspective

Reference 29

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.658661Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:184b0998a5f923e12a08b4479cb5aba2fe01d153fbdb65d48b99da9f420a919b

Observation 03328549-8306-432e-adc6-00a66af510bd · outbound

This paper cites ArXiv , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance ArXiv , year=

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.619755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:fcfa17d14cf3e7e79968bc91026c86436df64c4a17761a7046bddb08282138c2

Observation 8bb3ca51-c57b-4648-895e-466727ea8ea2 · outbound

This paper cites DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning

Reference 31

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:10.412848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:afd88e12420c1a695b36bde49526642c836ea6fc5f6fea30f4ba2d1c67bf7552

Observation d4cdce2b-625d-4c17-bdfb-ace2231e4964 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 32

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:10.305566Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:55ab9006501157fec21c9ee14d702cc4123276529b2b04aa89c7900c561f568c

Observation 85c87d47-dcf2-477d-bfef-63f09b9b67a1 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 33

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:10.310832Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:cacde54d70f21a806938abcd40213296345a686bb646a7b8626eb7a84add403e

Observation 6d10f557-afb1-4da6-84ed-02ee772bdb8d · outbound

This paper cites Notion Blog , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Notion Blog , year=

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.547178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:3f1a6963813b39198360b5c96b1a2dcd4dce5c3d7588915c4a1004e524069ec9

Observation 3e96a67c-9130-412f-8d9a-fe85ecd039a3 · outbound

This paper cites an unresolved cited work.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-05-22T06:21:11.551256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:4b5f05e401ba55b5ecf1c15cfa2ddf78ac4546c6c81d7fa23d32c3e143af5641

Observation 15dd5c13-112e-4a4c-9f75-4b4d98e09169 · outbound

This paper cites The Eleventh International Conference on Learning Representations.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance The Eleventh International Conference on Learning Representations

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.571555Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:5938a51175f9ea942373ca76268f34c17f4ed797c37d06cbbb14fd3ac855c521

Observation 38d0d04d-794f-4238-b296-0219924fbefb · outbound

This paper cites AIME 2025 , url =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance AIME 2025 , url =

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.600119Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:e5bded02df7b8ce194ece51a3f5fbc7a834e1f92d460b508b95394c6def4b644

Observation 262b4b21-8ef4-4131-9c4d-a50118df3874 · outbound

This paper cites AIME 2024 , url =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance AIME 2024 , url =

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.579795Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:dee527b0f8acd43c9c459053e45da2dfa5f1f6a82cf79482ff749b89d2ef4bad

Observation 163a6bcd-ac58-4ea1-b4fc-cf4fa01bddf8 · outbound

This paper cites The Twelfth International Conference on Learning Representations.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance The Twelfth International Conference on Learning Representations

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.592650Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:7a4fb2ddd35920ddfe6bef70c66d31312e39d28167c82445f71e4c943424fbd7

Observation 5c255bab-ba08-4569-97da-1ae470e1de98 · outbound

This paper cites GPT-4 Technical Report.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance GPT-4 Technical Report

Reference 40

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:09.747494Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:1ac4d4b28115f228ee8fe70bb309ab40635525d5ed4098dfb0f4130bd55de830

Observation f1254178-3e0a-4a06-a02c-7111d0ab9c6f · outbound

This paper cites 2025 , url =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance 2025 , url =

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.613006Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:7d02f5099e4a9f00d21bd98fe7dcff9116e01ad82f46aa05dfdf1b31ba0f59f6

Observation 604f0662-faf6-49e7-87a6-41b31def1ce5 · outbound

This paper cites StepHint: Multi-level Stepwise Hints Enhance Reinforcement Learning to Reason.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance StepHint: Multi-level Stepwise Hints Enhance Reinforcement Learning to Reason

Reference 42

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.335384Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:26b3e97d823dce82dd87c4aaa6444a6802b1ad35a0220037a581a0f66ebeacf5

Observation 0147729d-f7ca-43ce-9a93-407c4950d8c0 · outbound

This paper cites 2025 , eprint=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance 2025 , eprint=

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.673309Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:9f281f3833bcb5a285a56a5385ffc8b6332994402d9db16f67a118a7b0c32990

Observation f8877d16-bc46-4f28-92fc-c83228390b44 · outbound

This paper cites arXiv preprint arXiv:2508.11408 , year=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2508.11408 , year=

Reference 44

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.347381Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:fea4efa596c174562c6b6a560bb57122c96693b81bd30249de17bf82915ea52e

Observation b407e988-56e8-41a3-a359-0386d21965ba · outbound

This paper cites GHPO: Adaptive Guidance for Stable and Efficient LLM Reinforcement Learning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance GHPO: Adaptive Guidance for Stable and Efficient LLM Reinforcement Learning

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.364948Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:c2bc442504e54cc6b669f44bb0a25df92b61bcecf036d0da6a5d1eda67e9a6d4

Observation 24c0fa72-ffde-406c-a295-f2e6dd829cc8 · outbound

This paper cites arXiv preprint arXiv:2505.16984 , year =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance arXiv preprint arXiv:2505.16984 , year =

Reference 46

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.406692Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:4cf653d4bef2d32b5429e4c14157dbb6aa5f51c44d04adf644b1d0c261ea7bca

Observation 96a80a11-f43d-46f4-a21d-eb95fc43ec92 · outbound

This paper cites SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning

Reference 47

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.377765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:40e3b50740550ddad60c31d94d960451de0fd577ce6ae856fa1b0c394f6a6e90

Observation 1f647d1a-7b48-4272-b0b0-88039a0600c4 · outbound

This paper cites Qwen3 Technical Report.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Qwen3 Technical Report

Reference 48

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:10.341049Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:c806da844e381cbe92816a14af4281942faaba5467c9fe987494a0f989adacb3

Observation e241ea70-e93b-4277-9fe6-c43d77933497 · outbound

This paper cites XCOPA : A Multilingual Dataset for Causal Commonsense Reasoning.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance XCOPA : A Multilingual Dataset for Causal Commonsense Reasoning

Reference 49

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.533973Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:e701c3bfd2b2e573838d620eb5fabb4999a4abd0da4b5d1846351881d24be1e0

Observation 0b3cf418-91b4-4d6c-8da8-c0fb19df7a76 · outbound

This paper cites Few-shot Learning with Multilingual Language Models.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Few-shot Learning with Multilingual Language Models

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.328713Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:29adb2415aa572c936106d943d88f163388e4729f4d2a0927893a4b8323c2da0

Observation 79d7532d-6fc9-4146-ad84-e8bf14541905 · outbound

This paper cites an unresolved cited work.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Unresolved cited work

Reference 51

Resolution
unresolved
raw_fallback, observed 2026-05-22T06:21:11.607659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:5f171c4c3b5e2363c9d0cec1493776a10260c5af058927a1df5ba0fe88a2a43b

Observation f28d80af-1271-49f0-a6f9-581440dd6fb9 · outbound

This paper cites Generalized Slow Roll for Tensors.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Generalized Slow Roll for Tensors

Reference 52

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:09.604809Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-07-11T11:50:26.030339Z digest=sha256:6bb836128828269c5dc5b285778731a95356e76b17263b88a6bc9fd050b46c6e

Observation c67d6216-ad29-4182-bc2c-ddc9650365db · outbound

This paper cites MMLU-ProX: A Multilingual Benchmark for Advanced Large Language Model Evaluation.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance MMLU-ProX: A Multilingual Benchmark for Advanced Large Language Model Evaluation

Reference 53

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:10.383716Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:c924d43a2283a205f7be359e7cc7705b82dd4fe91fcbfed5f789cd410819c189

Observation eac3a3e9-3c43-4588-a489-71857d31bfa1 · outbound

This paper cites 2022 , eprint=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance 2022 , eprint=

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.603567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:c87d17191c36977386a9d7ccb75c4ad383c400b8349e211c8cfde98d05c2201c

Observation 80918205-7b94-4e92-8d60-4cf7297f8a1f · outbound

This paper cites 2021 , eprint=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance 2021 , eprint=

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.564618Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:d71ec946fc5e1d11bbcf1336c164d21565400f45179adfbbfa5080b1ee9869b6

Observation 9949bdc8-7595-4e9d-81b4-1bd9f298d1ad · outbound

This paper cites 2020 , url =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance 2020 , url =

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.567975Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:130d1b1305c5ed1d005de536eca47a3e05992183b0aaabe74a3940efa64c648a

Observation ef4c0240-c9e9-4a1d-a140-45b15ff05cac · outbound

This paper cites Is Bigger and Deeper Always Better? Probing LLaMA Across Scales and Layers.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Is Bigger and Deeper Always Better? Probing LLaMA Across Scales and Layers

Reference 57

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:09.621270Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:6af2e53ce6a235715a707938f3943037810d7a99bb4af5953f4a37b742589602

Observation b2b82dbb-5c6e-4f3d-967d-bae71c2c05fd · outbound

This paper cites How do Large Language Models Handle Multilingualism?.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance How do Large Language Models Handle Multilingualism?

Reference 58

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:09.700079Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:c092f5bbee7e3b7b4d482f06c2ec808f523aad4abb785698271c9bd61564455f

Observation fc7f0780-3e14-4efd-9804-e6de663bdc8c · outbound

This paper cites P - MME val: A Parallel Multilingual Multitask Benchmark for Consistent Evaluation of LLM s.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance P - MME val: A Parallel Multilingual Multitask Benchmark for Consistent Evaluation of LLM s

Reference 59

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.708654Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:2023965526f7097048cb7d69c39cfb0e326346b6e832a447f996e115316e8757

Observation 401e6c79-938b-4fab-b5d2-a292dfd0eec1 · outbound

This paper cites Humanity's Last Exam.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Humanity's Last Exam

Reference 60

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:09.584967Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:44e25bc14fdfff9c1fb8140acc2894f35f1eed70676fe91164563212e28ab0cd

Observation b6338a0e-fb06-4393-b47d-af13677cf1db · outbound

This paper cites Levesque and Ernest Davis and Leora Morgenstern , editor =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Levesque and Ernest Davis and Leora Morgenstern , editor =

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.555016Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:d6ea0c43e2feb82a17b4f93e8802c59961e105875c75640361c115b2943332ce

Observation d642e2eb-c366-4b69-84dd-ce065cbe0ec9 · outbound

This paper cites Gordon , title =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Gordon , title =

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.558956Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:093bbe6de837b45bb63d55e6ab723731f17d346307f382411e892867c128370c

Observation c554c4b0-c53d-4307-b081-29027461c322 · outbound

This paper cites Few-shot Learning with Multilingual Generative Language Models.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Few-shot Learning with Multilingual Generative Language Models

Reference 63

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.597591Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:dffc33ecc81c9fc03006718683650eeb7a029ec9b331b3ddf9fb84fe2294b419

Observation 9e7f99fb-98a7-4555-939b-313ef401c19d · outbound

This paper cites A Corpus and Cloze Evaluation for Deeper Understanding of Commonsense Stories.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance A Corpus and Cloze Evaluation for Deeper Understanding of Commonsense Stories

Reference 64

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.555628Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:762322d89dc30e52007f14613cead73d6d4c706be853967089ad8e5613f2fd6f

Observation dc8a9e6f-825a-4f86-b01a-8c46163da85d · outbound

This paper cites The Llama 3 Herd of Models.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance The Llama 3 Herd of Models

Reference 65

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:09.638081Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:8be5514a09011eed8123ca3eb945e9da278735c3e19cc5e82a19f327b2adde56

Observation d4a5b6d9-9cbb-40e4-9b29-12e08523d53f · outbound

This paper cites Light-R1: Curriculum SFT, DPO and RL for Long COT from Scratch and Beyond.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Light-R1: Curriculum SFT, DPO and RL for Long COT from Scratch and Beyond

Reference 66

Resolution
verified exact
arxiv_id, observed 2026-05-22T06:21:09.548667Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:b68fd995549b6b6aa315bd6697120adea3b48160d439a69eee2af54e62d7dc7d

Observation b3185cc4-cbfb-4e96-bb74-bd1616d44d53 · outbound

This paper cites Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers).

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)

Reference 67

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.729163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:84f975f235d3071d964f9797f4a860c19382b373d5805f0a11578000340567a1

Observation a222b94a-6ac9-499c-9e86-780c9595b19f · outbound

This paper cites NumGLUE.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance NumGLUE

Reference 68

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.592444Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:3e36045133ddb7d241a39398463755567b49fb466ebe52874cf4ef666c7a4482

Observation 7b9e04f8-a09a-4c74-9532-263ab512dbd7 · outbound

This paper cites an unresolved cited work.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Unresolved cited work

Reference 69

Resolution
parse uncertain
raw_fallback, observed 2026-05-22T06:21:11.676405Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:2744657f563a9490cdf56c14e71b5d65e508bd8ddabcf72c13da957a2126b7e0

Observation 248f9198-6fbb-494b-afb2-e1d062060765 · outbound

This paper cites No Language Left Behind: Scaling Human-Centered Machine Translation.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance No Language Left Behind: Scaling Human-Centered Machine Translation

Reference 70

Resolution
metadata mismatch
local_arxiv, observed 2026-05-22T06:21:09.742159Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:31a0129efc7e2f5944ec7b2d6dfb68e6318689cd193a8242594774de67a1d9b2

Observation fee103aa-f327-4ab2-9981-5cbe9ded6431 · outbound

This paper cites 2025 , url=.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance 2025 , url=

Reference 71

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.669483Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:63b3fe7b4ae11048eeadc95cda1e1fceecdf5dd6e816cb5aa6f26119f5e3b6df

Observation aabf15fa-57fc-424d-82bb-8d6e8d0d5114 · outbound

This paper cites SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild

Reference 72

Resolution
verified exact
local_arxiv, observed 2026-05-22T06:21:09.720075Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:05f8b6cab510f0856ab98520fc20777f3c294a652b6bbc5c1d091cda81dcf79e

Observation 24bc853d-44fe-43e1-beb3-2c3fd367a9b6 · outbound

This paper cites Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs

Reference 73

Resolution
verified exact
local_arxiv, observed 2026-05-22T06:21:09.650084Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:549658a35368ecceb27f645135da99c894253a67ff713d437955e86cdc0779ac

Observation ed58e4bc-598c-434f-a64a-003bc0dca810 · outbound

This paper cites A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions

Reference 74

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.615051Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:48f845613a19f6bafdaf038aec6c1064cbdcdea3654853eb0702cf36b929a913

Observation 3161205a-7f90-493b-848a-d4c213efa3aa · outbound

This paper cites Learning Fine-Grained Grounded Citations for Attributed Large Language Models , booktitle =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Learning Fine-Grained Grounded Citations for Attributed Large Language Models , booktitle =

Reference 75

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.724662Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:7b3aa71c017e183e04fc1ccc96a08ca59ac033cf152b2d4f89177d5c4267ef65

Observation 9cbed096-a97c-4ca0-8c4f-2ffd1fae5da4 · outbound

This paper cites Improving Contextual Faithfulness of Large Language Models via Retrieval Heads-Induced Optimization , booktitle =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Improving Contextual Faithfulness of Large Language Models via Retrieval Heads-Induced Optimization , booktitle =

Reference 76

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.622980Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:c24f29bbf21814b06faf208942ed858ba9c3560576d58cc480463bd700bda114

Observation dea12292-f86d-4ecd-806e-b39a128e56c6 · outbound

This paper cites Alleviating Hallucinations from Knowledge Misalignment in Large Language Models via Selective Abstention Learning , booktitle =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Alleviating Hallucinations from Knowledge Misalignment in Large Language Models via Selective Abstention Learning , booktitle =

Reference 77

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.664946Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:9e2c7c207b5d37d086260560222a9bfa4ad626d7ba1c6c9576efca7afb3d808e

Observation ab426810-bc68-4d26-bc79-ae328f402fe0 · outbound

This paper cites Advancing Large Language Model Attribution through Self-Improving , booktitle =.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Advancing Large Language Model Attribution through Self-Improving , booktitle =

Reference 78

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.713388Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:d97b54208bc3281c0f31993c03a71087953f434f0dfacbf0b16db85f5d1ed073

Observation 7c644739-e1ac-4c3a-be99-f4a8a5a4d1a5 · outbound

This paper cites C lue A nchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance C lue A nchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation

Reference 79

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.693429Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:63531b8fe10f4cd7376f96a3e39c7705c5dd6035c8543eb25f5e8b08a102b4d4

Observation d4c905e8-5870-4fb9-bbc3-0291593e3da5 · outbound

This paper cites Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models

Reference 80

Resolution
verified exact
arxiv_id, observed 2026-06-09T02:06:14.022585Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:f04c4d37cc0da77ce4482c3a5fd43dd09dba083a4dcf1834fe6be25ffca302e3

Observation e64c8e8c-f3be-4664-a8ca-a110edcb6ab1 · outbound

This paper cites CM -Align: Consistency-based Multilingual Alignment for Large Language Models.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance CM -Align: Consistency-based Multilingual Alignment for Large Language Models

Reference 81

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.610163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:37bef688f8c4ba70e83d43104f2210d5f7b3304c1562aa20aaa2b2ab22df4c37

Observation d481b79a-ca56-4797-aa7a-68b596109b6e · outbound

This paper cites Multilingual Knowledge Editing with Language-Agnostic Factual Neurons.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Multilingual Knowledge Editing with Language-Agnostic Factual Neurons

Reference 82

Resolution
verified fuzzy
raw_fallback, observed 2026-05-22T06:21:11.616668Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:c2a08ee1bd8cd55004c69bd6b0820c3aef9c09eeb6ae7295cbdbb24df9200cbe

Observation 20d2ccfc-d17f-43a9-ac68-3682258b3bd3 · outbound

This paper cites Less, but Better: Efficient Multilingual Expansion for LLM s via Layer-wise Mixture-of-Experts.

LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance Less, but Better: Efficient Multilingual Expansion for LLM s via Layer-wise Mixture-of-Experts

Reference 83

Resolution
verified exact
doi, observed 2026-05-22T06:21:09.688610Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-22T06:19:44.377733Z digest=sha256:6ad75a12e42e1e144456065c5242396484a0309884bc86eddae47b31137aa5e3

Pith citing papers

No inbound Pith citation observations are available.