Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-04T20:49:37.950968Z
Paper Citation Record · LEDGER
As of 10 August 2026, this Paper Citation Record lists 100 of 113 outbound references and 0 inbound Pith citation observations for arXiv:2509.08329.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-04T20:49:37.950968Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
100 of 113 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 97998644-e4a1-4020-a550-a00f6d742ba2 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Leveraging more of biology in evolutionary reinforcement learning
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c79f6e3a-6f0c-4178-9e7f-8170e7c57446 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Reinforcement learning: A survey
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 34f310e9-2063-451b-a77b-437c94e076ab · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Model-based reinforcement learning: A survey
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 820a1662-99eb-4d92-b9ca-db254e92371f · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Implementation of Q-Learning algorithm for solving maze prob- lem
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b2731e05-0d63-49c3-ae8f-e6780a86f9fd · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Sequence learning: From recognition and prediction to sequential decision making
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bf08b2d6-0a04-4df6-abf1-3e1b1a14c4ec · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Deep reinforcement learning for sequence-to-sequence models
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7e868f39-1469-4e0e-8d56-3512a90b8b41 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Adaptive look-ahead economic dispatch based on deep reinforcement learning
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 382bac6f-afd6-418c-8d7b-5b2176d1caf2 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Recent developments of game theory and reinforce- ment learning approaches: A systematic review
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 850b7ca9-92ae-44e6-80db-9f70a33b25a9 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Recent advances in reinforcement learning-based autonomous driving behavior planning: A survey
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9efd5625-d009-4fa2-bf0f-8182676441b7 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Rein- forcement learning for autonomous process control in industry 4.0: Advantages and challenges
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 616f27f5-48e6-4a55-be90-9af4abd9da0e · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing A review of safe reinforcement learning: Methods, theories and applications
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 56a2af26-ba0a-43bd-a36f-becdce148d43 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Distributed deep reinforcement learning based gradient quantization for federated learning enabled vehi- cle edge computing
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5bde60e4-7b2c-4bbc-b1df-ad5dce53b398 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing A review of research on reinforcement learning algorithms for multi-agents
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bb36baed-bee1-4509-9533-f174a228d9b0 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Toward enhanced reinforcement learning-based resource management via digital twin: Opportunities, applications, and challenges
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4a718f5b-19d3-4b29-9a15-f13c145ebb75 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Human-level control through deep reinforcement learning
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c207e56b-9b43-485d-9dfc-fe9d160967de · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Evolu- tionary reinforcement learning: a systematic review and future directions
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6c017dfb-3f69-4f08-90ca-fae28ecfb380 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing RL-Pruner: Structured Pruning Using Reinforcement Learning for CNN Compression and Acceleration
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 37eb84f2-8d3a-4e10-afa7-b5768e6658d0 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing A Reinforcement Learning Training Acceleration Method Based on Knowledge Distillation
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ef49b158-ab05-4ac1-bbbf-565c6e550954 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Plan-based reward shaping for reinforcement learning
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6279c055-d5d8-495c-907a-9d83eb08c3c8 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Cur- riculum learning for reinforcement learning domains: A framework and survey
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bda7df39-dbd7-42f9-92e9-eb3f2758db26 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Learning for a robot: Deep reinforcement learning, imitation learning, transfer learning
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8e3be7d4-cfe9-4dca-9b49-c9c20463f502 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Meta-learning in reinforcement learning
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a83b7b2c-630d-41c5-8d9e-db6c08b215e3 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing How Can LLM Guide RL? A Value-Based Approach
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation cf13cf78-cf9a-4331-8e3c-a3fba642522a · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing GPT-4 Technical Report
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e52e8950-48be-4834-b1c4-cc78dd31c809 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a0f7a012-0b4a-4f90-b47f-fbaa755b948e · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 913436a7-c629-4377-b252-e8cf67bbe361 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Teacher-Student Architecture for Knowledge Distillation: A Survey
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e04ffcf8-cdfd-4dbd-884c-1b5eaac566bd · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Towards Generalizable Agents in Text-Based Educational Environments: A Study of Integrating RL with LLMs
Reference 30
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation b0066dd9-a966-4ce1-ab4f-09c8b0de1e33 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Intelligent Control of Closed-Loop Sedation in Simulated ICU Patients
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1597274e-961e-4ec4-944f-f03f2bc0ae98 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Unresolved cited work
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation acd467bf-ea7c-4160-a5b2-b9d962c60299 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Unresolved cited work
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 34523da3-6534-4058-b5aa-cc1ead0ac15a · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing A reinforcement learning approach to obtain treatment strategies in sequential medi- cal decision problems
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 53a8f259-8ef5-400f-a719-c7ccf1e195ef · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Rein- forcement Learning for Closed-Loop Propofol Anesthesia: A Study in Human V olunteers
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 347e3caa-c511-46cc-b297-818ee7f161cb · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing 7. Using Reinforcement Learning in the Algorithmic Trading Problem
Reference 36
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation a3256e0d-893c-444e-9021-ae12db819375 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Deep Reinforcement Learning for Optimizing Finance Portfolio Man- agement
Reference 37
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation c53ff995-c701-4e02-8882-a2275dbdb1ab · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Reinforcement Learning for Solving the Vehicle Routing Problem
Reference 38
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2c21783d-75c7-4b29-975f-3a8c51007b14 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Reinforcement Learning Boat Autopilot: A Sample-efficient and Model Predictive Control based Approach
Reference 39
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 54991b6d-13a6-4817-a373-dd84d3210b0b · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Sutton and Andrew G
Reference 40
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e0e642b9-ee61-4a04-996d-35055efbedef · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Reinforcement learning in artificial and biological systems
Reference 41
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0668dfd1-9c6f-4d29-a824-321a3255a638 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Introduction to reinforcement learning
Reference 42
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4b58e068-7a7c-4c2f-8d16-18e029473e81 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing A generalized reinforcement-learning model: Convergence and appli- cations
Reference 43
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ccf8d915-cb40-4d7d-98b0-323acc5edf54 · outbound
Reference 44
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8b5c1543-1014-43c2-97c2-b3a5d7bdbaba · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Value-free reinforcement learning: policy optimization as a minimal model of operant behavior
Reference 45
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2b0fb647-960b-40ae-96f3-0d4afa374a99 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Actor-Critic Reinforcement Learning and Ap- plication in Developing Computer-Vision-Based Interface Tracking
Reference 46
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 839563fb-30a3-40a9-879d-a59e2a374504 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Unresolved cited work
Reference 47
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 7a4a842e-b2c9-4199-a853-d628c09366ae · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Gemini: A Family of Highly Capable Multimodal Models
Reference 48
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d7f5c7ec-2cb9-4311-a3c5-9a50cccdc799 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Large Language Models: A Survey
Reference 49
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c73edb9b-9207-47b4-a80d-777ac9b2c41d · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing A Survey of Large Language Models
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 169ab558-0904-4eea-bb73-fc619308b5ed · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Large language models surpass human experts in predicting neuroscience results
Reference 51
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 485da6c9-08c4-4a10-8cbf-b76a49004695 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing How Much Knowledge Can You Pack Into the Parameters of a Language Model?
Reference 52
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9c18f6c0-8fca-4bcd-ae23-f34ed48ba83b · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Analyzing Commonsense Emergence in Few-shot Knowledge Models
Reference 53
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0b5c305f-85f3-488f-adda-02849442b081 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Do LLMs Understand User Preferences? Evaluating LLMs On User Rating Prediction
Reference 54
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9f8804ac-45b9-4662-98e4-939c42c56458 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing TALLRec: An Effec- tive and Efficient Tuning Framework to Align Large Language Model with Recommendation
Reference 55
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8eea794a-f34f-4b0f-871a-1ac091ca6bd7 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing LLM-Rec: Personalized Recommendation via Prompting Large Language Models
Reference 56
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 71897617-f03c-4e26-b5b0-151f869fecf6 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Review-driven Personalized Preference Reasoning with Large Language Models for Recommendation
Reference 57
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation c677e816-9da8-457b-8bb7-e528754de729 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Wordcraft: Story Writing With Large Lan- guage Models
Reference 58
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e341a6e8-33f9-4a6f-a4c2-604358fccd77 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing A comprehensive survey on integrating large language models with knowledge-based methods
Reference 59
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 320b0594-c9cb-4101-9eb6-3d784beb10ea · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Large Language Models for Scientific Synthesis, Inference and Explanation
Reference 60
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f258a823-2377-476b-86e8-218e3598e0d6 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Leveraging Encoder-only Large Language Models for Mobile App Review Feature Extraction
Reference 61
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation d52c73ad-74e1-4e7d-bcd0-a80835ca7701 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Data Augmentation using Large Language Models: Data Perspectives, Learning Paradigms and Challenges
Reference 62
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 167ab8dd-bad4-450b-9ae0-7a8b773e333e · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Large Language Models as Data Preprocessors
Reference 63
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c25e1175-70f2-4f7b-994b-d805a28f3250 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing DiarizationLM: Speaker Diarization Post-Processing with Large Language Models
Reference 64
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 52f1937a-41ac-4b9b-8cb2-d023b6eb67c9 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Data Augmentation for Intent Classification with Off-the-shelf Large Language Models
Reference 65
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7b17a9e9-a00a-4fb3-b3f6-3743389564d0 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing When and how to paraphrase for named entity recognition?
Reference 66
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2d5c61ac-b1b9-4897-b28f-e07023de6692 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Does Collaborative Human-LM Dialogue Generation Help Information Extraction from Human Dialogues?
Reference 67
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 471b3a71-5314-4d8c-92b9-b09b593b1b8c · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing The Llama 3 Herd of Models
Reference 68
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 49b0f118-b64e-4178-9d88-ddb33e141722 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Unresolved cited work
Reference 69
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 19340d35-d8dc-492b-a01e-da2c002f59f8 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Democratizing LLMs: An Exploration of Cost-Performance Trade-offs in Self-Refined Open-Source Models
Reference 70
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation e0747679-0ef8-45fc-8748-90c167363d09 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Open-Source AI-Powered Optimization in Scalene: Advancing Python Performance Profiling with DeepSeek-R1 and LLaMA 3.2
Reference 71
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 962487d1-4a09-403b-9316-9085a2f737fb · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Reinforcement Learning Enhanced LLMs: A Survey
Reference 72
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 686ddd5b-ecaa-4113-8836-f4563aff8576 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Unresolved cited work
Reference 73
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3949d292-4765-4560-832c-495e536ca763 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Critic-Guided Decoding for Controlled Text Generation
Reference 74
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a8ea7f94-81e9-4deb-96e4-6287b9e6be76 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Reward modeling for mitigating toxicity in transformer- based language models
Reference 75
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8b673578-115d-4b94-a7b6-5a32df5b2d83 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Safe RLHF: Safe Reinforcement Learning from Human Feedback
Reference 76
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5c83c194-5500-4e25-8fcd-2a01803b5c5d · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Reflexion: Language Agents with Verbal Reinforcement Learning
Reference 77
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c03c4cad-38a5-4fd7-b10b-54ea38f68ead · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing CodeRL: Mastering Code Generation through Pretrained Models and Deep Reinforcement Learning
Reference 78
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 390243b3-4aaf-49c1-a16e-221c9a50427c · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback
Reference 79
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 328e2211-4bb1-46a9-81e1-360362a1d399 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Large Language Model as a Policy Teacher for Training Reinforcement Learning Agents
Reference 80
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a0f5f510-9372-4477-8cdc-0e2fba197146 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing 2025.URL:https://openreview.net/forum? id=6y00rooi7i
Reference 81
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 7c42d6f5-becd-4159-bdfc-9ca99d52ee0a · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing iLLM-TSC: Integration reinforcement learning and large language model for traffic signal control policy improvement
Reference 82
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7cf13e67-2e61-4feb-8c4c-2dafb40dba46 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxon- omy, and Methods
Reference 83
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 36150866-9739-4fc0-89e7-099a1d5f47f7 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Learning by Reusing Previous Advice in Teacher- Student Paradigm
Reference 84
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 04655b6d-2442-46b1-a37f-8cb5c2c79635 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Minigrid & miniworld: modular & customizable reinforcement learning environments for goal-oriented tasks
Reference 85
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 21d1212b-e624-4f07-9804-cbf5cdfcecbe · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing MiniHack the Planet: A Sandbox for Open-Ended Reinforcement Learning Research
Reference 86
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation afd4d3b6-33c3-4d96-8c29-c5fe411cd001 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Benchmarking the Spectrum of Agent Capabilities
Reference 87
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 251ee647-48b4-4447-bdd0-a77c3aaaf30a · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing LLM Augmented Hierarchical Agents
Reference 88
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation b0ec105d-082d-40bb-bc08-ef0c9092a0f0 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Teaching on a budget: agents advising agents in reinforcement learn- ing
Reference 89
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 2db3009c-2e21-4587-a067-103389989162 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Simultaneously Learning and Advising in Multiagent Reinforcement Learning
Reference 90
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 4708b46a-adca-41e8-a124-064c92278cf0 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Multitask Prompted Training Enables Zero-Shot Task Generalization
Reference 91
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation df71067c-76a5-43fe-bd15-57f36c7c681f · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Language Models are Few-Shot Learners
Reference 92
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9ceff9e6-c61b-4420-a61f-2df51d321fd0 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks
Reference 93
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c388a109-cd3e-4377-9484-3db35a08d0b8 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Unresolved cited work
Reference 94
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 3fbc8c99-6316-40d1-a694-bf2e9412fe14 · outbound
Reference 95
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 8a031c54-11f9-43b3-9d6b-f8de9eb01719 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing SPRIG: Improving Large Language Model Performance by System Prompt Optimization
Reference 96
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dc7b8055-0f57-4de5-ac93-93d04dc9001c · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing A Prompt Pattern Catalog to Enhance Prompt Engineering with ChatGPT
Reference 97
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b19d0852-b7a0-48af-b8f5-a59931772fc7 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing ReAct: Synergizing Reasoning and Acting in Language Models
Reference 98
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7d6491d8-6382-46ce-8df1-de2c91c42dc9 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing On the Partitioning of GPU Power among Multi-Instances
Reference 99
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation 9ca0dc91-adc6-4ea1-84c7-35e27eeb421f · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Gymnasium: A Standard Interface for Reinforcement Learning Environments
Reference 100
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 839ed5fb-3ec6-4362-8bc4-6d1680a95ca0 · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Local Large Language Models for Complex Structured Medical Tasks
Reference 101
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
Observation fb9bfbc1-5c07-4cf1-964a-569affae9c8b · outbound
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing Comprehensive testing of large language models for extraction of structured data in pathology
Reference 102
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.
No inbound Pith citation observations are available.