Pith. sign in

Paper Citation Record · LEDGER

Online Pre-Training for Offline-to-Online Reinforcement Learning

As of 7 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 3 inbound Pith citation observations for arXiv:2507.08387.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.08387 v1

Coverage vector

measured 12 of 12 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T18:27:02.708438Z

measured 15 of 15 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-26T01:05:48.492775Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T15:59:57.315756Z

Reference resolution

12 of 12 outbound references displayed

  • verified exact1
  • verified fuzzy0
  • unresolved11
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 70448eb6-02dc-4ca0-8d32-b2962ff27521 · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning Offline Reinforcement Learning with Implicit Q-Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.078580Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.078580Z digest=sha256:4840039bacc8bd50a853e81a7d8db32da3385afa4472d44790be0143225312ee

Observation e8add5fa-25f2-47b3-a186-b4b2f4dd8c22 · outbound

This paper cites Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems.

Online Pre-Training for Offline-to-Online Reinforcement Learning Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.302036Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.302036Z digest=sha256:30a00e48495365028c5c0a7efe1a75d074e231caf51e151628b6502d2efc9cf3

Observation 139326c2-25fc-4f29-9fc1-fc61249429a7 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning Behavior Regularized Offline Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.540489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.540489Z digest=sha256:c8d17dad1c0d18048b97b4ec01cc6c24c173315ae323502a954a9c64b9a96057

Observation e7981c2a-9b58-4e68-ae9f-df17a4c05f3b · outbound

This paper cites Policy Expansion for Bridging Offline-to-Online Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning Policy Expansion for Bridging Offline-to-Online Reinforcement Learning

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.595382Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.595382Z digest=sha256:866431e1382c3164f335b3d696751c8b94302ce2e7806ca3f1079351638c4367

Observation cef0550a-dc3a-48f4-bc45-579eaf9092e5 · outbound

This paper cites an unresolved cited work.

Online Pre-Training for Offline-to-Online Reinforcement Learning Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T18:27:03.180117Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T18:27:02.708438Z digest=sha256:d3afa4329a6f83561c6114158f0e1df6f4074781baa572629d81cef2232679e1

Observation 767f32c3-af73-45db-9a21-063a76a9d3bb · outbound

This paper cites Hybrid RL: Using Both Offline and Online Data Can Make RL Efficient.

Online Pre-Training for Offline-to-Online Reinforcement Learning Hybrid RL: Using Both Offline and Online Data Can Make RL Efficient

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.465774Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.465774Z digest=sha256:1c7b67d21e87bc382cc5f15bdf91cb5496979d72313171b117556032dbb238b4

Observation e179b792-806c-4c03-b1dc-e6abe6b28564 · outbound

This paper cites Off-policy deep reinforcement learning without exploration.

Online Pre-Training for Offline-to-Online Reinforcement Learning Off-policy deep reinforcement learning without exploration

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:01.903914Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:01.903914Z digest=sha256:46fd9842098d985a652c4de26b594c6d388a52d3eecffd8f7aa4b4480fae0e71

Observation a521ed32-5016-4189-875c-5695f1d06c55 · outbound

This paper cites PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.388148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.388148Z digest=sha256:ceec9b590f779b4a159021c24d5ca997e7f176b0e594457c95679ed71b8711df

Observation 5e0cd23f-e002-4ffd-83a0-31b9d45c059b · outbound

This paper cites Layer Normalization.

Online Pre-Training for Offline-to-Online Reinforcement Learning Layer Normalization

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:01.669315Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:01.669315Z digest=sha256:285dcb6cc27b4f44d4400433c1f22407781c591c0810236e21a20ec75c2c8c5e

Observation 2a44186e-6c90-44c6-af47-8afd10ca96dc · outbound

This paper cites Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization.

Online Pre-Training for Offline-to-Online Reinforcement Learning Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.192611Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.192611Z digest=sha256:343716da10167e0d931fd28cf7766bfe6a9aa81fb1465325133eb2e52fffd2d6

Observation fbc7a964-c092-41de-8e68-022358a47638 · outbound

This paper cites Bayesian Design Principles for Offline-to-Online Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning Bayesian Design Principles for Offline-to-Online Reinforcement Learning

Reference 2023

Resolution
verified exact
local_arxiv, observed 2026-08-06T18:27:02.961961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T18:27:01.968442Z digest=sha256:de3b014208500df21b68d307cea4d1a32bd22d3406ef0a6971fab10e57203ea8

Observation 09342699-cb04-4d35-88c8-39d28b86cf15 · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:01.793519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:01.793519Z digest=sha256:420c0139744c29091d6d376c807b4d0f61a10e16ec859e50967d4d5c7e8c147c

Pith citing papers

Observation c21f1114-17c6-47b2-9d84-4946eeee4052 · inbound

SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data cites this paper.

SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data Online Pre-Training for Offline-to-Online Reinforcement Learning

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-11T18:41:08.546937Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-08T14:54:30.895137Z digest=sha256:a212fa45bc16c6f2b6936f867f01ab7e3607c7fc1a62ae9c08045560efce9899

Observation 9e7b10ab-4a70-45b0-92d6-eedf3ac1f6cc · inbound

SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data cites this paper.

SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data Online Pre-Training for Offline-to-Online Reinforcement Learning

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-21T09:19:56.737206Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-21T09:15:11.280343Z digest=sha256:041165d195fb45ef7f9b36f538f20e9ec6b835083d8f6ab3392ea36f74d88afe

Observation f2bddfb0-1199-487d-93f3-8229f9b8363b · inbound

Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources cites this paper.

Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources Online Pre-Training for Offline-to-Online Reinforcement Learning

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-07-04T15:59:57.317358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-26T01:05:48.492775Z digest=sha256:72c7b22d0ebcfe1ee3525c9ace46188d7afecfd017a5ae8f1db2e6396408de7f