Pith. sign in

Paper Citation Record · LEDGER

Online Pre-Training for Offline-to-Online Reinforcement Learning

As of 12 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 3 inbound Pith citation observations for arXiv:2507.08387.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.08387 v1

Coverage vector

measured 12 of 12 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T18:27:02.708438Z

measured 15 of 15 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-26T01:05:48.492775Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T15:59:57.315756Z

Reference resolution

12 of 12 outbound references displayed

  • verified exact1
  • verified fuzzy0
  • unresolved11
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 70448eb6-02dc-4ca0-8d32-b2962ff27521 · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning Offline Reinforcement Learning with Implicit Q-Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.078580Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.078580Z digest=sha256:22cbab28934fe791cb7df475a8e07775e2855d97d72db40e50bb0b0baef47801

Observation e8add5fa-25f2-47b3-a186-b4b2f4dd8c22 · outbound

This paper cites Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems.

Online Pre-Training for Offline-to-Online Reinforcement Learning Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.302036Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.302036Z digest=sha256:38775aeef6bcbe8eb0e74d2de868a9660a3155f6b3156e02fc799de62102ac25

Observation 139326c2-25fc-4f29-9fc1-fc61249429a7 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning Behavior Regularized Offline Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.540489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.540489Z digest=sha256:a9c8f8394d7100f2fbdc059573ff291eafc3f416083bc887c4571c1f20a3cd58

Observation e7981c2a-9b58-4e68-ae9f-df17a4c05f3b · outbound

This paper cites Policy Expansion for Bridging Offline-to-Online Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning Policy Expansion for Bridging Offline-to-Online Reinforcement Learning

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.595382Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.595382Z digest=sha256:0075bda56450bdd854e5b2a719fc6aabaecf4cf08151709a6feadbc1bf35f2e0

Observation cef0550a-dc3a-48f4-bc45-579eaf9092e5 · outbound

This paper cites an unresolved cited work.

Online Pre-Training for Offline-to-Online Reinforcement Learning Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T18:27:03.180117Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T18:27:02.708438Z digest=sha256:39d2e65ac3da5ad3830660054170076a963593ec58d40f9cec44ac0586a93625

Observation 767f32c3-af73-45db-9a21-063a76a9d3bb · outbound

This paper cites Hybrid RL: Using Both Offline and Online Data Can Make RL Efficient.

Online Pre-Training for Offline-to-Online Reinforcement Learning Hybrid RL: Using Both Offline and Online Data Can Make RL Efficient

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.465774Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.465774Z digest=sha256:6f4274c025e3192abe122838fa11b36a38672f26bcd014b0b0a30d4c16008f96

Observation e179b792-806c-4c03-b1dc-e6abe6b28564 · outbound

This paper cites Off-policy deep reinforcement learning without exploration.

Online Pre-Training for Offline-to-Online Reinforcement Learning Off-policy deep reinforcement learning without exploration

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:01.903914Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:01.903914Z digest=sha256:ad3c97e37b17bf5b4c5951d0186ae1dd5129854fe19355d361ce5ccd70d3e1c9

Observation a521ed32-5016-4189-875c-5695f1d06c55 · outbound

This paper cites PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.388148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.388148Z digest=sha256:e6992c0779eb68ca2d3d756009ad3e80e69033c22bec0478eca82d092baab98d

Observation 5e0cd23f-e002-4ffd-83a0-31b9d45c059b · outbound

This paper cites Layer Normalization.

Online Pre-Training for Offline-to-Online Reinforcement Learning Layer Normalization

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:01.669315Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:01.669315Z digest=sha256:eaede879d121f24fcf2ab10cbe20f54e6ae80235598c05d0d2992fbf8d3360d8

Observation 2a44186e-6c90-44c6-af47-8afd10ca96dc · outbound

This paper cites Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization.

Online Pre-Training for Offline-to-Online Reinforcement Learning Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:02.192611Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:02.192611Z digest=sha256:3f9c04aceaa051abba550f68522ccac443a4e045abf1ef807f13b937f610ed1c

Observation fbc7a964-c092-41de-8e68-022358a47638 · outbound

This paper cites Bayesian Design Principles for Offline-to-Online Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning Bayesian Design Principles for Offline-to-Online Reinforcement Learning

Reference 2023

Resolution
verified exact
local_arxiv, observed 2026-08-06T18:27:02.961961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T18:27:01.968442Z digest=sha256:27629ef6f5df21b3016860a02248861297e5abfa72635eb6aae1cdfbba32a334

Observation 09342699-cb04-4d35-88c8-39d28b86cf15 · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

Online Pre-Training for Offline-to-Online Reinforcement Learning D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-06T18:27:01.793519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:27:01.793519Z digest=sha256:89324013db8e295177edf718caaa493b35679a5fb17c8c3fa921f2d19bf5b384

Pith citing papers

Observation c21f1114-17c6-47b2-9d84-4946eeee4052 · inbound

SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data cites this paper.

SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data Online Pre-Training for Offline-to-Online Reinforcement Learning

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-11T18:41:08.546937Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-08T14:54:30.895137Z digest=sha256:7f006ca37974a97036ff2a2b805850faf688e4937ac0589295beb805daeac27c

Observation 9e7b10ab-4a70-45b0-92d6-eedf3ac1f6cc · inbound

SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data cites this paper.

SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data Online Pre-Training for Offline-to-Online Reinforcement Learning

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-21T09:19:56.737206Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-21T09:15:11.280343Z digest=sha256:658530f3c6286453955d910c2243c89f314d0255038a89b90e0c9dbe64825445

Observation f2bddfb0-1199-487d-93f3-8229f9b8363b · inbound

Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources cites this paper.

Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources Online Pre-Training for Offline-to-Online Reinforcement Learning

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-07-04T15:59:57.317358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-06-26T01:05:48.492775Z digest=sha256:8b88aa15e6a1775d92c03aa6a769347a74b45a8c516931d17e29f3d8137ccd04