{"as_of":"2026-08-12T08:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ade9da443ee9c594fad3a0882d9f45a176eeeb8d83f16d7df80752273bbf007","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.22567/citation-record","integrity":"/paper/2605.22567/integrity","json":"/paper/2605.22567/citation-record.json","paper":"/paper/2605.22567"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:41.882557Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"3b24e866-df37-4bb0-b39b-6083b8905877","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:0289a94c12556f3954cba5c60da9f84595276e1942113bbf1c851fe22ce0fbc9","observation_id":"5bae1058-3cc9-4b12-94b0-af4fa8223685","resolution":{"observed_at":"2026-05-22T06:21:11.529799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa07dbbb-550c-473a-9ed6-cdf37e9e2422","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:a09872c2a3a73e9810febd72059813f38146429a612dc43ca0b547c074184b70","observation_id":"3bf6452e-08eb-467b-b33a-0cd7d666021a","resolution":{"observed_at":"2026-05-22T06:21:11.509632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Linjuan Wu, Hao-Ran Wei, Jialong Tang, Shuang Luo, Baosong Yang, Fei Huang, Yongliang Shen, Weiming Lu","venue":null,"work_id":"f332c515-5bbc-4000-97fe-81ec5ef5b8ae","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:3097790242a7b60e19359b11cbf6a20682909a2227539f584492f1dd22f2fb1c","observation_id":"6ee4a7c3-c25b-4d02-9cd6-d64d2ba24e7d","resolution":{"observed_at":"2026-05-22T06:21:11.576028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p19-1426","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"author Feng, Y","venue":null,"work_id":"08b4a008-6559-49d2-a88f-e50a9fe3771b","year":2019},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:611d9ccf1c634c92daa169f77954ccff15173d56a2d5920beccc8426eeb01255","observation_id":"b8dbf2a1-6ea5-439a-be72-65acad0a72cb","resolution":{"observed_at":"2026-05-22T06:21:09.664647Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.04597","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2603.04597 , year=","venue":null,"work_id":"300d7ddf-e7bd-4d85-87f5-a760a8ff9871","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:edbb6283bc7b14fca1a8ff02cf3e41c301030352eb5c750d1e034505ba7a2955","observation_id":"d1e0b85b-49dd-4146-91c6-acddfbf6890b","resolution":{"observed_at":"2026-05-22T06:21:10.288365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.666","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models","venue":null,"work_id":"cf60f6be-e5ed-4af9-bdaa-f7536a8a5c19","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:57fd31de8e6bee7a05fa08f897f5aa90a72174b20047f2c5d4bf2e84a51f94f5","observation_id":"2b6cd2a7-4e11-41c1-bcfc-6ec30de4e053","resolution":{"observed_at":"2026-05-22T06:21:09.570764Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SLAM : Towards Efficient Multilingual Reasoning via Selective Language Alignment","venue":null,"work_id":"481a5d1f-cf3c-42a4-bd85-7fef46870fb3","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:97ee7be84262d3ab3786c8319ce5f5f57b21c3c00584ab2ba04058eab5bf2136","observation_id":"9335aab5-fd03-402d-87e2-93709a5939e1","resolution":{"observed_at":"2026-05-22T06:21:11.588074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.19097","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2603.19097 , year=","venue":null,"work_id":"13cd86da-a35a-495b-8205-24dcb5485c3b","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:f6048ab795e5fd8c720c2f02d08561b8039bdd35275f71b20055ad08c19ac2e8","observation_id":"7503c952-5389-4ac6-8628-beba2da63df0","resolution":{"observed_at":"2026-05-22T06:21:10.358940Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09095","last_updated":"2021-01-27T03:39:20Z","snapshot_observed_at":"2026-08-09T01:07:21.765684Z","submitted_at":"2020-04-20T07:19:22Z","title":"The State and Fate of Linguistic Diversity and Inclusion in the NLP World","version":3},"cited_work":{"arxiv_id":"2004.09095","doi":"10.18653/v1/2020.acl-main.560","metadata_source":"doi_reference","pith_arxiv_id":"2004.09095","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The State and Fate of Linguistic Diversity and Inclusion in the NLP World","venue":"Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics","work_id":"d68649c1-8da0-4d01-b8cd-b2c849e505ca","year":2020},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2004.09095","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:6bab4570f235a7587fd2ebf7813fdbdb951f89c2caaaecfffed49757d65fb608","observation_id":"ec387173-3331-4db6-be7a-7e341ab79c9e","resolution":{"observed_at":"2026-05-22T06:21:09.675547Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:07.907033+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:07.907033+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"First Conference on Language Modeling , year=","venue":null,"work_id":"e830ef95-84d6-46cc-8b6a-6b0e4fbe91f5","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:755fd5008e4b3c479b4ad9bef8e271783f83a0ca7f4f3db7d7a7eed04c2550cb","observation_id":"9840533d-2457-4aa3-a52d-24c48e4aa7bf","resolution":{"observed_at":"2026-05-22T06:21:11.596511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i41.40798","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , author=","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"ee2c619a-3645-4526-88f2-fdb73c75d4aa","year":2026},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:df82908b21f071c363aed1b98a81deaabac563e932c4b6760d5d312717034bec","observation_id":"4a0c7831-f9bd-48cf-8e11-4ec8bc526bf0","resolution":{"observed_at":"2026-05-22T06:21:09.539145Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-09T23:15:21.901660Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":"2505.05408","doi":"10.48550/arxiv.2505.05408","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crosslingual Reasoning through Test-Time Scaling , journal =","venue":"ArXiv.org","work_id":"53916003-c6d6-4691-ba7d-7cb30312123a","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:299a79a4427978b74b5c0018a8c7562b8de11bb0d3d6effd4f6093a95d772db0","observation_id":"30689f68-2d9f-4fe7-981c-5de38d68dd74","resolution":{"observed_at":"2026-05-22T06:21:09.735534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.14768","doi":"10.48550/arxiv.2502.14768","metadata_source":"pith","pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","venue":"cs.CL","work_id":"b1f42628-30b7-4593-80ff-813523035c23","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:5f144bc9e0b43e0d38bb21620d6506b0cbb9bd602d30421e358f8aa8fe0aa613","observation_id":"3535989b-63c8-41f7-9c24-184949ddf50b","resolution":{"observed_at":"2026-05-22T06:21:10.322563Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.132","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Mixing in Reasoning Language Models: Patterns, Impact, and Internal Causes","venue":null,"work_id":"509d3ef1-bfe8-478b-9526-44a504aba5e5","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:9df34c8026c19d9354237c4ed87c0469b00d54874bfe939748086ba64ecdab50","observation_id":"2ef391bd-b367-4118-9c1d-a0d3a37edb50","resolution":{"observed_at":"2026-05-22T06:21:09.643169Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.293","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is LLM an Overconfident Judge? Unveiling the Capabilities of LLM s in Detecting Offensive Language with Annotation Disagreement","venue":null,"work_id":"3a2e8284-a31b-47f5-b004-80c14919d3b3","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:1972d8f20a2a3f58aee5fecf229b347bed34a792d8ec9eb6862d2510d6ba7b66","observation_id":"436603ab-cb2a-4bfa-af7d-ad303dec3d7e","resolution":{"observed_at":"2026-05-22T06:21:09.626079Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:8033e4535d046f5abde5f93eb1a038ac90dc3eccf8b7faf35d855e01ae481ea5","observation_id":"cc2b17b6-010c-44c9-bdc5-147dc4987fb9","resolution":{"observed_at":"2026-05-22T06:21:09.564669Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.18428","doi":"10.48550/arxiv.2504.18428","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2504.18428 , year=","venue":"ArXiv.org","work_id":"ef6ae10b-f47b-410c-981f-61f8d161b4ca","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:4fbf6106a074853b3f74cc841cf3a8ef3c579823acd0ba3010a485ec8e7d4cd0","observation_id":"9953abc3-9f37-45cc-ae1a-ad8445afdabe","resolution":{"observed_at":"2026-05-22T06:21:10.353284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:19.540486+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:19.540486+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.598","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MMATH : A Multilingual Benchmark for Mathematical Reasoning","venue":null,"work_id":"498c3b0f-1412-4d7b-b60a-2807de231984","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:d87f03bafb0e11108394c74b958b8857dabdddcd49669d0f2331f8c384607a5f","observation_id":"1a3dde83-27e3-4fc0-a356-cef691412fc4","resolution":{"observed_at":"2026-05-22T06:21:09.704310Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.1103","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When Models Reason in Your Language: Controlling Thinking Language Comes at the Cost of Accuracy","venue":null,"work_id":"04aec85c-01ae-4f85-8240-d2c70ec88a96","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:998d2e65dc81b159eb837f88fa1a83237afba3483466b52b34471d4581894ffc","observation_id":"33ec0069-9e7e-4184-b0a1-941996780236","resolution":{"observed_at":"2026-05-22T06:21:09.684054Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15508","last_updated":"2025-05-21T13:27:38Z","snapshot_observed_at":"2026-08-10T19:26:09.750901Z","submitted_at":"2025-05-21T13:27:38Z","title":"Multilingual Test-Time Scaling via Initial Thought Transfer","version":1},"cited_work":{"arxiv_id":"2505.15508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15508","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.15508 , year=","venue":null,"work_id":"9d18606f-6f13-428b-8e63-b8815ffe50b6","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2505.15508","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:c9978ad7b2c43b5cbb09678b8d8fe3d8d78b707ea709f877f421d5939a9abc60","observation_id":"f37eed6b-c595-4646-9f36-97379e886015","resolution":{"observed_at":"2026-05-22T06:21:10.394898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.05418","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.130358Z","title":"arXiv preprint arXiv:2507.05418 , year=","venue":null,"work_id":"04ba1f07-9548-487f-9bfb-f3bbdd0e1734","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:fed8eb45c2e042c6b6e5c211163f3c7d6b7703f2b97b82f48aad7e6b2e88f34c","observation_id":"f39d86af-1277-411f-bba2-62e51deb5309","resolution":{"observed_at":"2026-05-22T06:21:10.389125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.05850","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.05850 , year=","venue":null,"work_id":"4ac3ee12-53b5-49c9-a0ff-aa15018fc822","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:06d8c7c455cf2f54287a40bc4a0cc2fc0c7d2b94475a1b066c77ead3ab27e6aa","observation_id":"5ec0a21a-04a2-4143-9f15-a7cfd43cd343","resolution":{"observed_at":"2026-05-22T06:21:10.400852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.105862Z","title":"arXiv preprint arXiv:2510.07300 , year=","venue":null,"work_id":"6a64452f-1413-4934-90cc-d37e0b405375","year":2026},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:a91a68bd2ae7c2fa798c00abaf6d38df1844e208d870ab9e709e68c4df144d5a","observation_id":"9ab76d68-14be-492e-9f8a-fb775ea418be","resolution":{"observed_at":"2026-05-22T06:21:10.370544Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.02272","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:59:52.137990Z","title":"arXiv preprint arXiv:2510.02272 , year=","venue":null,"work_id":"a50807be-34a4-4d17-922e-b6f8baa61ee5","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:8f72078cbffee051e4b67e5603fd495afdc4e59d9ee3952fdbd34373307bc90c","observation_id":"eef01423-0a90-4078-ae3c-95505687db18","resolution":{"observed_at":"2026-05-22T06:21:10.418963Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05520","last_updated":"2026-06-21T17:23:43Z","snapshot_observed_at":"2026-08-07T16:07:46.182926Z","submitted_at":"2025-04-07T21:31:31Z","title":"Efficient Reinforcement Finetuning via Adaptive Curriculum Learning","version":4},"cited_work":{"arxiv_id":"2504.05520","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.05520","snapshot_observed_at":"2026-07-02T06:06:41.035177Z","title":"Efficient reinforcement finetuning via adaptive curriculum learning","venue":"cs.LG","work_id":"1fd0e7bd-02fb-4c5a-983a-db6847f2320f","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2504.05520","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:650ef46feab899c95f6ca798a081487c31fcd88237375559ffb304407c7d49f5","observation_id":"33edb356-7d2c-4636-ab08-b5cc52b0963d","resolution":{"observed_at":"2026-06-23T03:13:10.410609Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.09388","last_updated":"2026-06-22T08:02:17Z","snapshot_observed_at":"2026-08-07T16:09:47.648297Z","submitted_at":"2025-10-10T13:42:03Z","title":"Don't Tell the Answer, Truly Guide the Reasoning During RL Rollouts","version":2},"cited_work":{"arxiv_id":"2510.09388","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.09388","snapshot_observed_at":"2026-07-03T04:17:37.366812Z","title":"arXiv preprint arXiv:2510.09388 , year=","venue":"cs.LG","work_id":"1fe37a13-fb50-4f1c-96e1-5547d8e39bf5","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2510.09388","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:1be0d845c9b8afe8c3675c08a64e19cd305603b02b97823387a2d61b058a43fa","observation_id":"9ab7fb25-0ce4-449e-b178-1a2e6f78d139","resolution":{"observed_at":"2026-06-23T04:13:40.575864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.470","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"F ast C u RL : Curriculum Reinforcement Learning with Stage-wise Context Scaling for Efficient Training R1-like Reasoning Models","venue":null,"work_id":"95866d71-3cb9-4f01-ad4e-65024427a8ca","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:8827d1a4ad03f89d9b645087cd8f8b25db1df5fbb5dc70a46baa71f4e02febf7","observation_id":"23f61bfc-1d93-4359-bfc2-29a17a5582dd","resolution":{"observed_at":"2026-05-22T06:21:09.631137Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.13266","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:33:45.179662Z","title":"arXiv preprint arXiv:2507.13266 , year=","venue":null,"work_id":"2777f86e-068c-4ead-913e-0704721bc8f6","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:dc972a99306ce4c37abad339997d05784a6e84ba7a112c4466a775d36fc15f62","observation_id":"a78a41be-ffcf-42fa-a9a9-8721c63cc08b","resolution":{"observed_at":"2026-05-22T06:21:10.317325Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.406","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding the Repeat Curse in Large Language Models from a Feature Perspective","venue":null,"work_id":"92d1f03a-e0de-4a06-abf2-d298e3453221","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:184b0998a5f923e12a08b4479cb5aba2fe01d153fbdb65d48b99da9f420a919b","observation_id":"191902fe-f9b7-457f-a8ab-53c5cf24bd31","resolution":{"observed_at":"2026-05-22T06:21:09.658661Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"06f22ee6-4219-4b7e-bb64-5cd3b279d47c","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:fcfa17d14cf3e7e79968bc91026c86436df64c4a17761a7046bddb08282138c2","observation_id":"03328549-8306-432e-adc6-00a66af510bd","resolution":{"observed_at":"2026-05-22T06:21:11.619755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11456","last_updated":"2025-05-22T19:12:14Z","snapshot_observed_at":"2026-08-10T19:38:46.551479Z","submitted_at":"2025-04-15T17:59:51Z","title":"DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning","version":2},"cited_work":{"arxiv_id":"2504.11456","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11456","snapshot_observed_at":"2026-07-09T03:25:57.840663Z","title":"DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning","venue":"cs.CL","work_id":"3dea79f1-73da-4db2-8d7b-64013c3c5fa5","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2504.11456","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:afd88e12420c1a695b36bde49526642c836ea6fc5f6fea30f4ba2d1c67bf7552","observation_id":"8bb3ca51-c57b-4648-895e-466727ea8ea2","resolution":{"observed_at":"2026-05-22T06:21:10.412848Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:55ab9006501157fec21c9ee14d702cc4123276529b2b04aa89c7900c561f568c","observation_id":"d4cdce2b-625d-4c17-bdfb-ace2231e4964","resolution":{"observed_at":"2026-05-22T06:21:10.305566Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:cacde54d70f21a806938abcd40213296345a686bb646a7b8626eb7a84add403e","observation_id":"85c87d47-dcf2-477d-bfef-63f09b9b67a1","resolution":{"observed_at":"2026-05-22T06:21:10.310832Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Notion Blog , year=","venue":null,"work_id":"6009c5c9-6dd2-43d6-a941-2353e8112bf4","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:3f1a6963813b39198360b5c96b1a2dcd4dce5c3d7588915c4a1004e524069ec9","observation_id":"6d10f557-afb1-4da6-84ed-02ee772bdb8d","resolution":{"observed_at":"2026-05-22T06:21:11.547178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T05:53:21.176822Z","title":null,"venue":null,"work_id":"fcb2329e-f074-48c3-b5ef-b6747295d375","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:4b5f05e401ba55b5ecf1c15cfa2ddf78ac4546c6c81d7fa23d32c3e143af5641","observation_id":"3e96a67c-9130-412f-8d9a-fe85ecd039a3","resolution":{"observed_at":"2026-05-22T06:21:11.551256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T19:01:19.735176Z","title":"The Eleventh International Conference on Learning Representations","venue":null,"work_id":"8431db31-b213-4549-a9ed-dec8174790d3","year":2023},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:5938a51175f9ea942373ca76268f34c17f4ed797c37d06cbbb14fd3ac855c521","observation_id":"15dd5c13-112e-4a4c-9f75-4b4d98e09169","resolution":{"observed_at":"2026-05-22T06:21:11.571555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AIME 2025 , url =","venue":null,"work_id":"a55d91db-0120-43b9-9814-e74b1e18848d","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:e5bded02df7b8ce194ece51a3f5fbc7a834e1f92d460b508b95394c6def4b644","observation_id":"38d0d04d-794f-4238-b296-0219924fbefb","resolution":{"observed_at":"2026-05-22T06:21:11.600119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AIME 2024 , url =","venue":null,"work_id":"13cf603e-1cc6-41d7-9a70-8fd14a01a4cb","year":2024},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:dee527b0f8acd43c9c459053e45da2dfa5f1f6a82cf79482ff749b89d2ef4bad","observation_id":"262b4b21-8ef4-4131-9c4d-a50118df3874","resolution":{"observed_at":"2026-05-22T06:21:11.579795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:11:42.092743Z","title":"The Twelfth International Conference on Learning Representations","venue":null,"work_id":"0971bb9b-52fd-4ee7-9bd9-38110d7f09c8","year":2024},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:7a4fb2ddd35920ddfe6bef70c66d31312e39d28167c82445f71e4c943424fbd7","observation_id":"163a6bcd-ac58-4ea1-b4fc-cf4fa01bddf8","resolution":{"observed_at":"2026-05-22T06:21:11.592650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:1ac4d4b28115f228ee8fe70bb309ab40635525d5ed4098dfb0f4130bd55de830","observation_id":"5c255bab-ba08-4569-97da-1ae470e1de98","resolution":{"observed_at":"2026-05-22T06:21:09.747494Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:11:42.051265Z","title":"2025 , url =","venue":null,"work_id":"ccfaa807-9e58-47d7-8901-fed63e36c700","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:7d02f5099e4a9f00d21bd98fe7dcff9116e01ad82f46aa05dfdf1b31ba0f59f6","observation_id":"f1254178-3e0a-4a06-a02c-7111d0ab9c6f","resolution":{"observed_at":"2026-05-22T06:21:11.613006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02841","last_updated":"2025-07-03T17:51:06Z","snapshot_observed_at":"2026-08-09T11:34:54.873283Z","submitted_at":"2025-07-03T17:51:06Z","title":"StepHint: Multi-level Stepwise Hints Enhance Reinforcement Learning to Reason","version":1},"cited_work":{"arxiv_id":"2507.02841","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02841","snapshot_observed_at":"2026-07-04T20:00:08.075019Z","title":"arXiv preprint arXiv:2507.02841 , year=","venue":null,"work_id":"505a6600-5d71-4c01-86c3-4ea91b231a87","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2507.02841","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:26b3e97d823dce82dd87c4aaa6444a6802b1ad35a0220037a581a0f66ebeacf5","observation_id":"604f0662-faf6-49e7-87a6-41b31def1ce5","resolution":{"observed_at":"2026-05-22T06:21:10.335384Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"daf72c01-ae43-48d6-8831-e1d4d87e7770","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:9f281f3833bcb5a285a56a5385ffc8b6332994402d9db16f67a118a7b0c32990","observation_id":"0147729d-f7ca-43ce-9a93-407c4950d8c0","resolution":{"observed_at":"2026-05-22T06:21:11.673309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.11408","doi":"10.48550/arxiv.2508.11408","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2508.11408 , year=","venue":"arXiv (Cornell University)","work_id":"994df3c4-5dc6-45c0-9db5-e82e415ce5d8","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:fea4efa596c174562c6b6a560bb57122c96693b81bd30249de17bf82915ea52e","observation_id":"f8877d16-bc46-4f28-92fc-c83228390b44","resolution":{"observed_at":"2026-05-22T06:21:10.347381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.10628","last_updated":"2025-07-16T15:30:11Z","snapshot_observed_at":"2026-08-11T00:34:58.024801Z","submitted_at":"2025-07-14T08:10:00Z","title":"GHPO: Adaptive Guidance for Stable and Efficient LLM Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2507.10628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.10628","snapshot_observed_at":"2026-07-04T20:00:08.029366Z","title":"arXiv preprint arXiv:2507.10628 , year=","venue":null,"work_id":"e6ef51f6-345c-4a8e-9007-3f3df283b908","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2507.10628","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:c2bc442504e54cc6b669f44bb0a25df92b61bcecf036d0da6a5d1eda67e9a6d4","observation_id":"b407e988-56e8-41a3-a359-0386d21965ba","resolution":{"observed_at":"2026-05-22T06:21:10.364948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16984","doi":"10.48550/arxiv.2505.16984","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2505.16984 , year =","venue":"ArXiv.org","work_id":"bbfb0a1d-2534-4c65-823f-c70998a97ecf","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:4cf653d4bef2d32b5429e4c14157dbb6aa5f51c44d04adf644b1d0c261ea7bca","observation_id":"24c0fa72-ffde-406c-a295-f2e6dd829cc8","resolution":{"observed_at":"2026-05-22T06:21:10.406692Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19767","last_updated":"2025-06-24T16:31:37Z","snapshot_observed_at":"2026-08-06T23:00:22.849455Z","submitted_at":"2025-06-24T16:31:37Z","title":"SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.19767","doi":"10.48550/arxiv.2506.19767","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19767","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.19767 , year=","venue":"ArXiv.org","work_id":"03d392b0-d6dc-44a8-bfdd-888ccbc9e68e","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2506.19767","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:40e3b50740550ddad60c31d94d960451de0fd577ce6ae856fa1b0c394f6a6e90","observation_id":"96a80a11-f43d-46f4-a21d-eb95fc43ec92","resolution":{"observed_at":"2026-05-22T06:21:10.377765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:c806da844e381cbe92816a14af4281942faaba5467c9fe987494a0f989adacb3","observation_id":"1f647d1a-7b48-4272-b0b0-88039a0600c4","resolution":{"observed_at":"2026-05-22T06:21:10.341049Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-main.185","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"XCOPA : A Multilingual Dataset for Causal Commonsense Reasoning","venue":null,"work_id":"99656da8-2940-4b84-b0b4-ec825fd5b595","year":2020},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:e701c3bfd2b2e573838d620eb5fabb4999a4abd0da4b5d1846351881d24be1e0","observation_id":"e241ea70-e93b-4277-9fe6-c43d77933497","resolution":{"observed_at":"2026-05-22T06:21:09.533973Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-22T12:23:09.034452+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T12:23:09.034452+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10668","last_updated":"2022-11-10T07:01:42Z","snapshot_observed_at":"2026-08-10T00:44:42.640325Z","submitted_at":"2021-12-20T16:52:35Z","title":"Few-shot Learning with Multilingual Language Models","version":3},"cited_work":{"arxiv_id":"2112.10668","doi":"10.48550/arxiv.2112.10668","metadata_source":"arxiv_reference","pith_arxiv_id":"2112.10668","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Diab and Veselin Stoyanov and Xian Li , title =","venue":"arXiv (Cornell University)","work_id":"32d56185-d394-41f6-a038-08c943a4650c","year":2021},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2112.10668","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:29adb2415aa572c936106d943d88f163388e4729f4d2a0927893a4b8323c2da0","observation_id":"0b3cf418-91b4-4d6c-8da8-c0fb19df7a76","resolution":{"observed_at":"2026-05-22T06:21:10.328713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:31:35.516699Z","title":null,"venue":null,"work_id":"b2fa25bb-75f7-4d60-b9a4-4bead50bd86e","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:5f171c4c3b5e2363c9d0cec1493776a10260c5af058927a1df5ba0fe88a2a43b","observation_id":"79d7532d-6fc9-4146-ad84-e8bf14541905","resolution":{"observed_at":"2026-05-22T06:21:11.607659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1405.2020","last_updated":"2014-05-08T17:04:15Z","snapshot_observed_at":"2026-08-04T16:50:32.529025Z","submitted_at":"2014-05-08T17:04:15Z","title":"Generalized Slow Roll for Tensors","version":1},"cited_work":{"arxiv_id":"1405.2020","doi":"10.1109/sc41405.2020","metadata_source":"pith","pith_arxiv_id":"1405.2020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Generalized Slow Roll for Tensors","venue":"astro-ph.CO","work_id":"32348cef-09e4-43f2-b53c-d785fa1937a5","year":2014},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/1405.2020","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:6bb836128828269c5dc5b285778731a95356e76b17263b88a6bc9fd050b46c6e","observation_id":"f28d80af-1271-49f0-a6f9-581440dd6fb9","resolution":{"observed_at":"2026-05-22T06:21:09.604809Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.178338+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.178338+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10497","last_updated":"2025-05-26T17:20:21Z","snapshot_observed_at":"2026-08-07T17:06:40.468097Z","submitted_at":"2025-03-13T15:59:20Z","title":"MMLU-ProX: A Multilingual Benchmark for Advanced Large Language Model Evaluation","version":2},"cited_work":{"arxiv_id":"2503.10497","doi":"10.48550/arxiv.2503.10497","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10497","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2503.10497 , year=","venue":"ArXiv.org","work_id":"932058b2-29f2-4aaf-b5b0-4cebd458e179","year":2023},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2503.10497","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:c924d43a2283a205f7be359e7cc7705b82dd4fe91fcbfed5f789cd410819c189","observation_id":"c67d6216-ad29-4182-bc2c-ddc9650365db","resolution":{"observed_at":"2026-05-22T06:21:10.383716Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"0c97daab-b910-4d3d-bc4e-6eccb805820c","year":2022},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:c87d17191c36977386a9d7ccb75c4ad383c400b8349e211c8cfde98d05c2201c","observation_id":"eac3a3e9-3c43-4588-a489-71857d31bfa1","resolution":{"observed_at":"2026-05-22T06:21:11.603567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , eprint=","venue":null,"work_id":"b9dae728-a005-4fa5-8836-bf4b5b9d3fb4","year":2021},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:d71ec946fc5e1d11bbcf1336c164d21565400f45179adfbbfa5080b1ee9869b6","observation_id":"80918205-7b94-4e92-8d60-4cf7297f8a1f","resolution":{"observed_at":"2026-05-22T06:21:11.564618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 , url =","venue":null,"work_id":"d5b1d4d7-6435-4fa2-b831-b82382909b1c","year":2020},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:130d1b1305c5ed1d005de536eca47a3e05992183b0aaabe74a3940efa64c648a","observation_id":"9949bdc8-7595-4e9d-81b4-1bd9f298d1ad","resolution":{"observed_at":"2026-05-22T06:21:11.567975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04333","last_updated":"2024-01-09T07:33:07Z","snapshot_observed_at":"2026-08-07T13:14:17.815045Z","submitted_at":"2023-12-07T14:50:41Z","title":"Is Bigger and Deeper Always Better? Probing LLaMA Across Scales and Layers","version":4},"cited_work":{"arxiv_id":"2312.04333","doi":"10.48550/arxiv.2312.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"c9e82353-cfa1-434c-9fe8-da198bf60ac1","year":2023},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2312.04333","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:6af2e53ce6a235715a707938f3943037810d7a99bb4af5953f4a37b742589602","observation_id":"ef4c0240-c9e9-4a1d-a140-45b15ff05cac","resolution":{"observed_at":"2026-05-22T06:21:09.621270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18815","last_updated":"2024-11-10T12:49:15Z","snapshot_observed_at":"2026-08-10T16:10:22.860140Z","submitted_at":"2024-02-29T02:55:26Z","title":"How do Large Language Models Handle Multilingualism?","version":3},"cited_work":{"arxiv_id":"2402.18815","doi":"10.48550/arxiv.2402.18815","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18815","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"8b9c04df-4a43-494d-a1f2-5e87c912e503","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2402.18815","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:c092f5bbee7e3b7b4d482f06c2ec808f523aad4abb785698271c9bd61564455f","observation_id":"b2b82dbb-5c6e-4f3d-967d-bae71c2c05fd","resolution":{"observed_at":"2026-05-22T06:21:09.700079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.242","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"P - MME val: A Parallel Multilingual Multitask Benchmark for Consistent Evaluation of LLM s","venue":null,"work_id":"eed3ed03-93be-4335-ab54-4c7d9c2a9db1","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:2023965526f7097048cb7d69c39cfb0e326346b6e832a447f996e115316e8757","observation_id":"fc7f0780-3e14-4efd-9804-e6de663bdc8c","resolution":{"observed_at":"2026-05-22T06:21:09.708654Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":"2501.14249","doi":"10.1038/s41586-025-09962-4","metadata_source":"pith","pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Humanity's Last Exam","venue":"cs.LG","work_id":"59ea00d4-16a8-45e1-aafc-290a6f91d9f4","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:44e25bc14fdfff9c1fb8140acc2894f35f1eed70676fe91164563212e28ab0cd","observation_id":"401e6c79-938b-4fab-b5d2-a292dfd0eec1","resolution":{"observed_at":"2026-05-22T06:21:09.584967Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Levesque and Ernest Davis and Leora Morgenstern , editor =","venue":null,"work_id":"f124c905-8c02-4512-aa84-306447f212e6","year":2012},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:d6ea0c43e2feb82a17b4f93e8802c59961e105875c75640361c115b2943332ce","observation_id":"b6338a0e-fb06-4393-b47d-af13677cf1db","resolution":{"observed_at":"2026-05-22T06:21:11.555016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gordon , title =","venue":null,"work_id":"54da952d-308e-4b0a-ac83-84fb3b9f4aa7","year":2011},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:093bbe6de837b45bb63d55e6ab723731f17d346307f382411e892867c128370c","observation_id":"d642e2eb-c366-4b69-84dd-ce065cbe0ec9","resolution":{"observed_at":"2026-05-22T06:21:11.558956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.616","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Few-shot Learning with Multilingual Generative Language Models","venue":null,"work_id":"74c8f60a-d0c4-40dd-9dcd-a2d9195f5e09","year":2022},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:dffc33ecc81c9fc03006718683650eeb7a029ec9b331b3ddf9fb84fe2294b419","observation_id":"c554c4b0-c53d-4307-b081-29027461c322","resolution":{"observed_at":"2026-05-22T06:21:09.597591Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n16-1098","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Corpus and Cloze Evaluation for Deeper Understanding of Commonsense Stories","venue":null,"work_id":"df936044-6b96-4226-84c4-757bbca2f19b","year":2016},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:762322d89dc30e52007f14613cead73d6d4c706be853967089ad8e5613f2fd6f","observation_id":"9e7f99fb-98a7-4555-939b-313ef401c19d","resolution":{"observed_at":"2026-05-22T06:21:09.555628Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:8be5514a09011eed8123ca3eb945e9da278735c3e19cc5e82a19f327b2adde56","observation_id":"dc8a9e6f-825a-4f86-b01a-8c46163da85d","resolution":{"observed_at":"2026-05-22T06:21:09.638081Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10460","last_updated":"2025-05-28T12:32:29Z","snapshot_observed_at":"2026-08-10T16:59:28.676649Z","submitted_at":"2025-03-13T15:29:22Z","title":"Light-R1: Curriculum SFT, DPO and RL for Long COT from Scratch and Beyond","version":4},"cited_work":{"arxiv_id":"2503.10460","doi":"10.48550/arxiv.2503.10460","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10460","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"83fc58bb-3060-4d01-ac57-a76ad19c36d6","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2503.10460","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:b68fd995549b6b6aa315bd6697120adea3b48160d439a69eee2af54e62d7dc7d","observation_id":"d4a5b6d9-9cbb-40e4-9b29-12e08523d53f","resolution":{"observed_at":"2026-05-22T06:21:09.548667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.539","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":"ba392427-170d-40a3-a3d3-ebe82d1c7515","year":2024},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:84f975f235d3071d964f9797f4a860c19382b373d5805f0a11578000340567a1","observation_id":"b3185cc4-cbfb-4e96-bb74-bd1616d44d53","resolution":{"observed_at":"2026-05-22T06:21:09.729163Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.246","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NumGLUE","venue":"Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"a42debc5-0995-421e-b896-404941bf6e86","year":2022},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:3e36045133ddb7d241a39398463755567b49fb466ebe52874cf4ef666c7a4482","observation_id":"a222b94a-6ac9-499c-9e86-780c9595b19f","resolution":{"observed_at":"2026-05-22T06:21:09.592444Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"94cefee4-67e9-4b19-922d-165617da803c","year":null},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:2744657f563a9490cdf56c14e71b5d65e508bd8ddabcf72c13da957a2126b7e0","observation_id":"7b9e04f8-a09a-4c74-9532-263ab512dbd7","resolution":{"observed_at":"2026-05-22T06:21:11.676405Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":"2207.04672","doi":"10.18653/v1/w19-5207","metadata_source":"pith","pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","venue":"cs.CL","work_id":"68c8336c-d20e-40fa-ba9c-89459da6fc1a","year":2022},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:31a0129efc7e2f5944ec7b2d6dfb68e6318689cd193a8242594774de67a1d9b2","observation_id":"248f9198-6fbb-494b-afb2-e1d062060765","resolution":{"observed_at":"2026-05-22T06:21:09.742159Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , url=","venue":null,"work_id":"a8a7a528-4dc1-4996-a8bf-d14ee171caf3","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:63b3fe7b4ae11048eeadc95cda1e1fceecdf5dd6e816cb5aa6f26119f5e3b6df","observation_id":"fee103aa-f327-4ab2-9981-5cbe9ded6431","resolution":{"observed_at":"2026-05-22T06:21:11.669483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":"2503.18892","doi":"10.48550/arxiv.2503.18892","metadata_source":"pith","pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","venue":"cs.LG","work_id":"94a68437-02e7-425a-91b2-5846ddcbd38c","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:05f8b6cab510f0856ab98520fc20777f3c294a652b6bbc5c1d091cda81dcf79e","observation_id":"aabf15fa-57fc-424d-82bb-8d6e8d0d5114","resolution":{"observed_at":"2026-05-22T06:21:09.720075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-08-08T21:52:29.510852Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":"2503.01307","doi":"10.48550/arxiv.2503.01307","metadata_source":"pith","pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","venue":"cs.CL","work_id":"f65a84bf-c5b4-4491-a618-18bb263c60e5","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:549658a35368ecceb27f645135da99c894253a67ff713d437955e86cdc0779ac","observation_id":"24bc853d-44fe-43e1-beb3-2c3fd367a9b6","resolution":{"observed_at":"2026-05-22T06:21:09.650084Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:43.212388+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:43.212388+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3703155","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:07:20.243096Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions","venue":"ACM Transactions on Information Systems","work_id":"ed8c5be1-1069-44c0-8dc4-627a7de3a371","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:48f845613a19f6bafdaf038aec6c1064cbdcdea3654853eb0702cf36b929a913","observation_id":"ed58e4bc-598c-434f-a64a-003bc0dca810","resolution":{"observed_at":"2026-05-22T06:21:09.615051Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-08T01:38:03.678418+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T01:38:03.678418+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.838","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning Fine-Grained Grounded Citations for Attributed Large Language Models , booktitle =","venue":null,"work_id":"b999d4ad-8379-4276-9a9d-508460e717b1","year":2024},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:7b3aa71c017e183e04fc1ccc96a08ca59ac033cf152b2d4f89177d5c4267ef65","observation_id":"3161205a-7f90-493b-848a-d4c213efa3aa","resolution":{"observed_at":"2026-05-22T06:21:09.724662Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving Contextual Faithfulness of Large Language Models via Retrieval Heads-Induced Optimization , booktitle =","venue":null,"work_id":"a60fa645-189d-4364-8ed8-08141010fd28","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:c24f29bbf21814b06faf208942ed858ba9c3560576d58cc480463bd700bda114","observation_id":"9cbed096-a97c-4ca0-8c4f-2ffd1fae5da4","resolution":{"observed_at":"2026-05-22T06:21:11.622980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alleviating Hallucinations from Knowledge Misalignment in Large Language Models via Selective Abstention Learning , booktitle =","venue":null,"work_id":"881cc317-7d38-4ae9-82c3-f842ade0815a","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:9e2c7c207b5d37d086260560222a9bfa4ad626d7ba1c6c9576efca7afb3d808e","observation_id":"dea12292-f86d-4ecd-806e-b39a128e56c6","resolution":{"observed_at":"2026-05-22T06:21:11.664946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.223","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Advancing Large Language Model Attribution through Self-Improving , booktitle =","venue":null,"work_id":"899055fb-8d39-4a02-8dd9-52f727369e09","year":2024},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:d97b54208bc3281c0f31993c03a71087953f434f0dfacbf0b16db85f5d1ed073","observation_id":"ab426810-bc68-4d26-bc79-ae328f402fe0","resolution":{"observed_at":"2026-05-22T06:21:09.713388Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.1049","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"C lue A nchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation","venue":null,"work_id":"0603827d-476a-4567-a89f-f5aaa97e86a4","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:63531b8fe10f4cd7376f96a3e39c7705c5dd6035c8543eb25f5e8b08a102b4d4","observation_id":"7c644739-e1ac-4c3a-be99-f4a8a5a4d1a5","resolution":{"observed_at":"2026-05-22T06:21:09.693429Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12996","last_updated":"2026-06-07T11:11:47Z","snapshot_observed_at":"2026-08-02T23:42:56.058178Z","submitted_at":"2026-02-13T15:07:35Z","title":"Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models","version":2},"cited_work":{"arxiv_id":"2602.12996","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12996","snapshot_observed_at":"2026-06-28T19:02:33.881898Z","title":"arXiv preprint arXiv:2602.12996 , year=","venue":"cs.CL","work_id":"4da2f129-0b8a-4393-9038-a98fb6127a02","year":2026},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2602.12996","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:f04c4d37cc0da77ce4482c3a5fd43dd09dba083a4dcf1834fe6be25ffca302e3","observation_id":"d4c905e8-5870-4fb9-bbc3-0291593e3da5","resolution":{"observed_at":"2026-06-09T02:06:14.022585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.1401","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CM -Align: Consistency-based Multilingual Alignment for Large Language Models","venue":null,"work_id":"bd8a8e67-2669-4182-b5b7-f55829f0db89","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:37bef688f8c4ba70e83d43104f2210d5f7b3304c1562aa20aaa2b2ab22df4c37","observation_id":"e64c8e8c-f3be-4664-a8ca-a110edcb6ab1","resolution":{"observed_at":"2026-05-22T06:21:09.610163Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-22T12:23:12.743735+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T12:23:12.743735+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multilingual Knowledge Editing with Language-Agnostic Factual Neurons","venue":null,"work_id":"c67c9b3c-8093-4a60-84f9-3ab548228f02","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:c2a08ee1bd8cd55004c69bd6b0820c3aef9c09eeb6ae7295cbdbb24df9200cbe","observation_id":"d481b79a-ca56-4797-aa7a-68b596109b6e","resolution":{"observed_at":"2026-05-22T06:21:11.616668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.878","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less, but Better: Efficient Multilingual Expansion for LLM s via Layer-wise Mixture-of-Experts","venue":null,"work_id":"5ec85e22-17a5-4fa0-8e62-7576d24d95da","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:6ad75a12e42e1e144456065c5242396484a0309884bc86eddae47b31137aa5e3","observation_id":"20d2ccfc-d17f-43a9-ac68-3682258b3bd3","resolution":{"observed_at":"2026-05-22T06:21:09.688610Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:32:54.127514Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":0,"metadata_mismatch":13,"parse_uncertain":1,"unresolved":3,"verified_exact":45,"verified_fuzzy":21},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 0 inbound Pith citation observations for arXiv:2605.22567."}