Pith. sign in

Paper Citation Record · LEDGER

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

As of 20 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 4 inbound Pith citation observations for arXiv:2411.10809.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.10809 v1

Coverage vector

measured 18 of 18 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T19:21:15.806376Z

measured 22 of 22 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 4 of 4 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T19:54:51.107296Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T19:30:07.936806Z

Reference resolution

18 of 18 outbound references displayed

  • verified exact2
  • verified fuzzy4
  • unresolved12
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 18771d1f-dd46-4b76-8a2a-7d135188cd84 · outbound

This paper cites On Tiny Episodic Memories in Continual Learning.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay On Tiny Episodic Memories in Continual Learning

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.659121Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.659121Z digest=sha256:ff065e61c46b646ae769c08482b000e995661def29b7a682b034dd3a8cf90896

Observation 702aa86b-6677-4309-84d7-b8cbd8fc11c2 · outbound

This paper cites AdaptDiffuser: Diffusion Models as Adaptive Self-evolving Planners.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay AdaptDiffuser: Diffusion Models as Adaptive Self-evolving Planners

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.682942Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.682942Z digest=sha256:c8675d7e751f0ab2e2f9aab03414d5951d9cbb3daed85fd88b23490ac3a55378

Observation 33c22658-9e03-40cb-b97e-683e4cce3246 · outbound

This paper cites A Survey on Model-based Reinforcement Learning.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay A Survey on Model-based Reinforcement Learning

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.710465Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.710465Z digest=sha256:d11114489dd03c837de67d7b91896d701287aa0db0a02f18ab3fc2d33ef360eb

Observation 0b2bf39d-4119-440f-82b5-849cd9f835ad · outbound

This paper cites Im- itating human behaviour with diffusion models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Im- itating human behaviour with diffusion models

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:21:16.314335Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T19:21:15.745030Z digest=sha256:fd68d95f63c25df031773895db0e0e1e48a9dc2a6491f09c3c3afae9baab4555

Observation bbdfb1e9-97a0-4d3d-a326-611990d53c41 · outbound

This paper cites High- resolution image synthesis with latent diffusion models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay High- resolution image synthesis with latent diffusion models

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:21:16.290765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T19:21:15.766013Z digest=sha256:0f968af032d341721d73e59f6428056d64147a2902c22fe6f214ed02e4ea53a2

Observation 7241d327-b860-4fff-8a75-961bb5d85189 · outbound

This paper cites SafeDiffuser: Safe Planning with Diffusion Probabilistic Models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay SafeDiffuser: Safe Planning with Diffusion Probabilistic Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.785796Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.785796Z digest=sha256:92aeaed60260e9ceaf8a27db6e80414acb1a1a3b6e3a0228a6bf0255a117b216

Observation 3a9e65a6-e1d7-4257-97b0-457b4d21bdb9 · outbound

This paper cites t-DGR: A trajectory-based deep generative replay method for continual learning in decision making.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay t-DGR: A trajectory-based deep generative replay method for continual learning in decision making

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:21:16.266129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T19:21:15.792245Z digest=sha256:3d94c910c0120947d2268c14350aa28d20c5a7a3509d182f87ac013bfee1106b

Observation 87da433e-bfc3-4b91-818b-a1d0a4b684aa · outbound

This paper cites Exploring Continual Learning of Diffusion Models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Exploring Continual Learning of Diffusion Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.798243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.798243Z digest=sha256:ed534c94ee3e0243f8ca93c4fd87b9aee08174783b4fed628e3c2bda161032f3

Observation 0459a2d7-3642-4c55-aa6d-b3b126e9935f · outbound

This paper cites MADiff: Offline Multi-agent Learning with Diffusion Models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay MADiff: Offline Multi-agent Learning with Diffusion Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.806376Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.806376Z digest=sha256:1e2aaf5c59a6ef77df56abae227f8c931f850ab2ed00281c26f9dbcb5689e51d

Observation 9a3bc1da-b79f-4e0d-a6b9-277d2c7e0ea5 · outbound

This paper cites UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction

Reference 1989

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.721771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.721771Z digest=sha256:7ee820e2b9924e1a8cb6de5c058e26e1ceb344e5e8dd102c29f1cecebc1a7556

Observation 5e665aec-e7d6-43d0-96f4-b16094ff9426 · outbound

This paper cites Goal-Conditioned Imitation Learning using Score-based Diffusion Policies.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Goal-Conditioned Imitation Learning using Score-based Diffusion Policies

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.755795Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.755795Z digest=sha256:af63ed297602a3c91a64f595b27171e5e5fa97da832d51b5943b8ef583a49716

Observation 972618b6-b6b1-43fd-8775-3091be6a1e11 · outbound

This paper cites Diffusion Model is an Effective Planner and Data Synthesizer for Multi-Task Reinforcement Learning.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Diffusion Model is an Effective Planner and Data Synthesizer for Multi-Task Reinforcement Learning

Reference 2018

Resolution
verified exact
local_arxiv, observed 2026-08-12T19:21:16.200814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T19:21:15.668449Z digest=sha256:73a8dd9676fb5889c3f753eda1bd0df7c839b5b857f21cc6052ee11cb1ed7273

Observation f0de0998-1ab6-4feb-b11c-0aca837bbcb8 · outbound

This paper cites Continual Learning in Neural Networks.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Continual Learning in Neural Networks

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.650251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.650251Z digest=sha256:cdad9c55a84fa7e4d4a3c693a7e25f7ddff2e805bc0962679c7e59f3dd8bab40

Observation b3017ada-96bc-49f8-8f42-93bf4b1ee0ba · outbound

This paper cites A Comprehensive Survey of Continual Learning: Theory, Method and Application.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay A Comprehensive Survey of Continual Learning: Theory, Method and Application

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.778771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.778771Z digest=sha256:f8d62b92883d1463927c869f2363cc179e52ff1cf40cb6c73671688c9e85d479

Observation f125ad51-7f30-425e-b3ec-2f2b87ea1692 · outbound

This paper cites Progressive Neural Networks.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Progressive Neural Networks

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.771993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.771993Z digest=sha256:b63cf56461c69f08006c45130bf7977fa12592d0bdb8eebfffe8848e0f7042b5

Observation c191ff02-d232-4e97-b5bb-d0560040d291 · outbound

This paper cites Auto-Encoding Variational Bayes.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Auto-Encoding Variational Bayes

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.676100Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.676100Z digest=sha256:885eb2bbac85e1b5dfef6e861b322944a62331e52ea32219c433503ea0e89baa

Observation aa9a42dc-91ac-4c79-b69d-c89d7b92268c · outbound

This paper cites MetaDiffuser: Diffusion Model as Conditional Planner for Offline Meta-RL.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay MetaDiffuser: Diffusion Model as Conditional Planner for Offline Meta-RL

Reference 2023

Resolution
verified exact
local_arxiv, observed 2026-08-12T19:21:16.065123Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T19:21:15.734406Z digest=sha256:e2a31153d4106c13de8368e1e5dc44cd533152bbd3d6ce7537cba1cd863c4563

Observation 2d187eee-ef9b-49f5-9310-d62e74dda94d · outbound

This paper cites Synthetic experience replay.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Synthetic experience replay

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:21:16.335144Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T19:21:15.692731Z digest=sha256:89bcb822fc725298ca4a1fc23ab5c6c8ecfd9a67998cc9cfbaa0b1684e4c1d34

Pith citing papers

Observation 49674be9-0832-491e-846f-1da97c8da846 · inbound

MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning cites this paper.

MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-15T19:54:51.107296Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T19:54:51.107296Z digest=sha256:27b1f0ad9ad4b7c5d0f45bbfaae6c1b258e528c029e3193b43d6f709684f25bc

Observation 32d0c95c-ff66-4c11-bfc3-314a4444684e · inbound

Continual Quadruped Robots Coordination via Semantic Skill Discovery cites this paper.

Continual Quadruped Robots Coordination via Semantic Skill Discovery Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-07-02T21:37:25.171324Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-27T19:37:53.168569Z digest=sha256:cb9f003ad245dd9ab2ae5643540acaff1fedae50c55447d63dcc7f3b18fde212

Observation ad1cc0a0-5926-448c-9f01-f62965cf8296 · inbound

Offline Multi-agent Continual Cooperation via Skill Partition and Reuse cites this paper.

Offline Multi-agent Continual Cooperation via Skill Partition and Reuse Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:30:07.938269Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-06-25T21:14:31.778575Z digest=sha256:51182b1e46154f461c5b116c14f4d48da4e11be5e70f7c0dd9aa09432f8b6f9a

Observation 9ae066cd-8993-4889-b00c-3638a169dfe7 · inbound

HyperDCM: Dynamic Cluster Memory Replay in Hyperbolic Space for Continual Robotic Navigation Across Scenes cites this paper.

HyperDCM: Dynamic Cluster Memory Replay in Hyperbolic Space for Continual Robotic Navigation Across Scenes Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T08:53:46.797845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T08:53:46.797845Z digest=sha256:09181fd66e75b3329c102f953b5d93141fc536fd4772656283c0f2dd04c7e3e8