Pith. sign in

Paper Citation Record · LEDGER

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning

As of 10 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2505.23871.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.23871 v2

Coverage vector

measured 43 of 43 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:55:54.416203Z

measured 44 of 44 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T05:01:15.443445Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-07T05:01:17.482077Z

Reference resolution

43 of 43 outbound references displayed

  • verified exact1
  • verified fuzzy22
  • unresolved19
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation f07df930-7dab-4be3-9ff6-a941c0221bf2 · outbound

This paper cites Ambient Diffusion Posterior Sampling: Solving Inverse Problems with Diffusion Models Trained on Corrupted Data.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Ambient Diffusion Posterior Sampling: Solving Inverse Problems with Diffusion Models Trained on Corrupted Data

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:49.402174Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:49.402174Z digest=sha256:893956acbc5687d1c7231ddae9ee3b6067e8f03b04878c9d9a810504bcd612f3

Observation 6806c56b-80d0-4f93-bbda-f07b6239954e · outbound

This paper cites Offline Reinforcement Learning from Datasets with Structured Non-Stationarity.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Offline Reinforcement Learning from Datasets with Structured Non-Stationarity

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:55:54.927932Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:49.514880Z digest=sha256:87f6fd31905573b005efbb321c9d1f8ddeb51508624e6bfeaf6f0dc063de4866

Observation ae3d6006-5349-4ead-8aad-7106da10dd1f · outbound

This paper cites Is conditional generative modeling all you need for decision making? In The Eleventh International Conference on Learning Representations, 2023.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Is conditional generative modeling all you need for decision making? In The Eleventh International Conference on Learning Representations, 2023

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:58.447137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:49.626930Z digest=sha256:5aac9061e926d7ae534b7f2816aeeaef3e8a641eeb3115dcac53d1a9cba02b06

Observation 4193ddd7-63bf-4de2-b501-5cff4344046b · outbound

This paper cites Uncertainty-based offline reinforcement learning with diversified q-ensemble.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Uncertainty-based offline reinforcement learning with diversified q-ensemble

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:58.320673Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:49.772302Z digest=sha256:69ed9ab6d6351a5bef4adcf8d63ac28edb0dfb3907624948e2d73b4de3bfd94f

Observation 8fc1e53c-519f-4b0e-996e-c04cbfd6fe86 · outbound

This paper cites Pessimistic Bootstrapping for Uncertainty-Driven Offline Reinforcement Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Pessimistic Bootstrapping for Uncertainty-Driven Offline Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:49.886568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:49.886568Z digest=sha256:ae4436373cbc85b9f22d74584f48b1eb8a84a237c1c897d9defe9bc0978f750e

Observation 0419cc4f-e479-4089-883d-e7c0c1657164 · outbound

This paper cites Decision transformer: Reinforcement learning via sequence modeling.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Decision transformer: Reinforcement learning via sequence modeling

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:50.011227Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:50.011227Z digest=sha256:38cd45cc23fa2c172db148af5ea3ec7cb73afca2bea709f8a11c0a448a41dace

Observation 8b641ced-b476-4710-bf8c-e9cf78a61c58 · outbound

This paper cites Exact policy recovery in offline rl with both heavy-tailed rewards and data corruption.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Exact policy recovery in offline rl with both heavy-tailed rewards and data corruption

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:58.188635Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:50.170867Z digest=sha256:dfb3964193de8c3f71de3b93b8d7b9f59488709a0f763d518f4db994527f7a22

Observation 901b35f6-a897-4991-b54a-fedcaa433656 · outbound

This paper cites Consistent diffusion meets tweedie: Training exact ambient diffusion models with noisy data.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Consistent diffusion meets tweedie: Training exact ambient diffusion models with noisy data

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:58.059697Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:50.323136Z digest=sha256:41d5fd141bb92efce5c6f107c9feadc2cde593ebb46cc9982f33c1dad5d89315

Observation bf4502ff-5025-487b-8de7-5dd4ed9c70ca · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:50.472027Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:50.472027Z digest=sha256:a503b01cb07ef61035e0cf5b6ea247097edf3c04645e525ea4e1459607c5b8f0

Observation c858ef78-624f-42f4-acee-de67074b791c · outbound

This paper cites A minimalist approach to offline reinforcement learn- ing.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning A minimalist approach to offline reinforcement learn- ing

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:50.601518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:50.601518Z digest=sha256:b7b4fec03d79202de570dafc3e3f2218d6c2b8b83a887a5ecce8ab94845c97ef

Observation 70525bd3-df61-4f38-8570-38c8e52a4f78 · outbound

This paper cites Off-policy deep reinforcement learning with- out exploration.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Off-policy deep reinforcement learning with- out exploration

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.948906Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:50.751884Z digest=sha256:999382b6637fccd1b90513b6356a47f079248ba03b9a0686c7903288c3cf968d

Observation ce47875b-e531-4665-b6ec-30fae9c7a8db · outbound

This paper cites Why so pessimistic? estimating uncertainties for offline rl through ensembles, and why their independence matters.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Why so pessimistic? estimating uncertainties for offline rl through ensembles, and why their independence matters

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.837287Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:50.996427Z digest=sha256:a8c60accb075adb57a3b1f8f425ccae2a11bbfce3064389887b6f0dc7417e772

Observation 7bb711e0-81f2-4b51-8742-16ae564a9b2c · outbound

This paper cites IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:51.086548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:51.086548Z digest=sha256:6cc05225a445bb76f25ae9c93da11809d2d3841c57363c3d0c1f06dec1499768

Observation 044294f5-e2f2-4677-a284-ce6e4a52f95d · outbound

This paper cites Denoising diffusion probabilistic models.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Denoising diffusion probabilistic models

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.670545Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:51.167694Z digest=sha256:cdf014191020155ef04a14e4bb83528888814ee00e6e64f6515dff732b3cdb69

Observation 71b1811b-c4c7-46d2-ad04-06838da71daf · outbound

This paper cites Planning with diffusion for flexible behavior synthesis.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Planning with diffusion for flexible behavior synthesis

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.509450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:51.268766Z digest=sha256:ec1ed29e350a269e7d6d6d3d75fca33d274d271fe44db4a806342dccb2927a2a

Observation 9dedea89-7914-4726-8c53-7e240630a2fd · outbound

This paper cites Offline reinforcement learning as one big sequence modeling problem.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Offline reinforcement learning as one big sequence modeling problem

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:51.378863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:51.378863Z digest=sha256:422b5fb9b11eb9e0f2a3e87eec94cad3c934564f1aa96c06804a45ee7297d535

Observation e84a4cd2-cafa-47e9-bfc4-3cb71585a727 · outbound

This paper cites Neural stochastic differential equations for uncertainty-aware offline rl.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Neural stochastic differential equations for uncertainty-aware offline rl

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.302674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:51.479404Z digest=sha256:7ab8a7f384b4fd37c4819b7006440189c16b3809e8ae0f5ef63b198a8874680d

Observation c4d21d72-cb97-4cb4-8a73-bdef2ef490e0 · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Offline Reinforcement Learning with Implicit Q-Learning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:51.589000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:51.589000Z digest=sha256:8cb85ed1c8112387a1498439522faacdf27795f90b309c7c991d341efdaf6371

Observation 51bdfcb9-5299-48f8-92cf-56ca80169906 · outbound

This paper cites Conservative q-learning for offline reinforcement learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Conservative q-learning for offline reinforcement learning

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.162259Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:51.696488Z digest=sha256:cea0b20c99f642792c6ec58cdc6e4440f30d7b89e98e954de6e11cad58425fa6

Observation 506ed5af-a7b9-447f-ab85-59acdc70cfa7 · outbound

This paper cites Offline reinforcement learning: Tutorial, review, and perspectives on open problems, 2020.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Offline reinforcement learning: Tutorial, review, and perspectives on open problems, 2020

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:51.841469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:51.841469Z digest=sha256:9154989c4bdf0727b96de882704703080bdd1ab91c30038e24940b16553743f7

Observation 20eb3195-e3be-45c8-8419-0ff7be9c8d52 · outbound

This paper cites Survival instinct in offline reinforcement learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Survival instinct in offline reinforcement learning

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.021913Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:51.953347Z digest=sha256:1f97c1376f22346c569cd70e45356226190689ec7a0fc84d4502002fe4da5703

Observation e1eb5478-0d2b-4072-9b61-e5f6d10d193a · outbound

This paper cites ROPO: Robust Preference Optimization for Large Language Models.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning ROPO: Robust Preference Optimization for Large Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.060026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.060026Z digest=sha256:c90c4f3ec9609b0d203d8a0ab09984300972746bc1cb18059bde05ed6150786a

Observation 0d4f3c54-dde8-45f3-bd3a-d8f6fc392673 · outbound

This paper cites Adapt- diffuser: Diffusion models as adaptive self-evolving planners.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Adapt- diffuser: Diffusion models as adaptive self-evolving planners

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.910769Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:52.171683Z digest=sha256:440c5834e4bc701705e01a4e9cf0ed2688af936886d0d1ee87a13141ce1ef73e

Observation 81d71945-2dc4-486e-8ea6-8491f145900c · outbound

This paper cites Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.250621Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.250621Z digest=sha256:e19a521d3bcda2876fd31f1084db39ed6cbe70cc900ee514418f43019dc9d668

Observation f2c5b186-0fa7-42c0-9625-32b4df67b044 · outbound

This paper cites Towards Deep Learning Models Resistant to Adversarial Attacks.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Towards Deep Learning Models Resistant to Adversarial Attacks

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.349876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.349876Z digest=sha256:386cc912dc7f84ec93e8e73fbbc50e94fbc3e5a9715cb3bd69dde68319bffd2e

Observation edc02cc5-db76-450b-8169-b5808703197b · outbound

This paper cites Robust re- inforcement learning using offline data.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Robust re- inforcement learning using offline data

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.832793Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:52.492092Z digest=sha256:416afb2fccf2c4c2a65884c77ff9324bb500e1b25c328edb462e0c4cac269c07

Observation a4fc0fb9-2b0a-4640-86f5-4b5c9827f731 · outbound

This paper cites High-resolution image synthesis with latent diffusion models.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning High-resolution image synthesis with latent diffusion models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.603920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.603920Z digest=sha256:a2f4e1b1b154e9567dd6343bad6a09298f704762ed1361b77c71653ef2895a1a

Observation 1d7ba50d-9111-434f-bda0-5b5d009993a2 · outbound

This paper cites Distributionally robust model-based offline reinforcement learning with near-optimal sample complexity.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Distributionally robust model-based offline reinforcement learning with near-optimal sample complexity

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.620400Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:52.715087Z digest=sha256:57ef82f483d1b7169e85995b4d561a782db37ba13f8007b3c26ab37a0ff6f419

Observation fa6ae2c6-7739-44b5-a371-55c774d36064 · outbound

This paper cites Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.772925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.772925Z digest=sha256:e1bd4c1082be172745123c6b1b958dc086915a74c41b5fddbfbd913336fa096a

Observation 03cb4af2-56f5-4eba-9fd3-1e8bf8881c8c · outbound

This paper cites Deep un- supervised learning using nonequilibrium thermodynamics.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Deep un- supervised learning using nonequilibrium thermodynamics

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.475138Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:52.882565Z digest=sha256:70da57f87150626234622b0f4d6a757b5d2c62a5a79d84e77ef18bae84d3daef

Observation d95c7342-e74a-4a3f-9126-2545d5b18d35 · outbound

This paper cites Score-based generative modeling through stochastic differential equations.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Score-based generative modeling through stochastic differential equations

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:53.023971Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:53.023971Z digest=sha256:eb3e55fc81de70e7815760da113fcb43f48e6cb91af05d59985f8dbe5fb79ce9

Observation e72e98e9-8ea3-4648-9020-99c453556ca2 · outbound

This paper cites Diffusion policies as an expressive policy class for offline reinforcement learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Diffusion policies as an expressive policy class for offline reinforcement learning

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.382385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:53.157210Z digest=sha256:61231c508634e16ff46a47ee565e61a1d6de9d135647bc980afcdcb6cc1d678d

Observation 397d09de-2df4-4cfc-b15f-04cefe7ba833 · outbound

This paper cites COPA: Certifying Robust Policies for Offline Reinforcement Learning against Poisoning Attacks.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning COPA: Certifying Robust Policies for Offline Reinforcement Learning against Poisoning Attacks

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:53.257474Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:53.257474Z digest=sha256:ea85c3cdb5c416289bcf62c2f3cea0f09c8d5244f468d984fd2ab0a58629c81b

Observation ae603eeb-7d7a-43b2-86bc-6f252b7d7d6a · outbound

This paper cites Tackling data corruption in offline reinforcement learning via sequence modeling.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Tackling data corruption in offline reinforcement learning via sequence modeling

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.317012Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:53.375177Z digest=sha256:a09b7299738542f719fc96799686d0b8739e4e7c4b26a85109c696aca878cfc7

Observation bec7e5bc-db01-4841-ab8d-ae899f31e0dc · outbound

This paper cites Rorl: Robust offline reinforcement learning via conservative smoothing.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Rorl: Robust offline reinforcement learning via conservative smoothing

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.126296Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:53.461873Z digest=sha256:fc263cb1dfbc6c7a20ca65762cd1e56bd5fb02443601dd098d8dd83485a457d7

Observation c2be624d-9675-487d-92de-65d134ad6429 · outbound

This paper cites Regularizing Hidden States Enables Learning Generalizable Reward Model for LLMs.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Regularizing Hidden States Enables Learning Generalizable Reward Model for LLMs

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:53.556785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:53.556785Z digest=sha256:ee2de720b3ffffb59b1ffcc152985ccd431cbbaa4725bfeef1749cb5c72262fa

Observation dc6e40a4-8c22-499d-916f-38b0606a70ab · outbound

This paper cites Towards robust offline reinforcement learning under diverse data corruption.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Towards robust offline reinforcement learning under diverse data corruption

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:55.958959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:53.638459Z digest=sha256:fe043538314dbbb5c2ac6c2ddfa18515bcaec307223f66aa3b2cebdfe8906d95

Observation c23335ab-2839-49a6-ba43-d10898ab60cb · outbound

This paper cites Dmbp: Diffusion model-based predictor for robust offline rein- forcement learning against state observation perturbations.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Dmbp: Diffusion model-based predictor for robust offline rein- forcement learning against state observation perturbations

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:55.796509Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:53.766842Z digest=sha256:601d4d7a889ae32a3953ac8a02e2ecfc811e3963b9b468ce7129438a0902b5ed

Observation 942f13a5-48d8-4637-8b4e-3dcb9e0b5a7a · outbound

This paper cites Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:53.920438Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:53.920438Z digest=sha256:afbefe0e08fce2672c7ed55ce6ff0ec0455f67480c55328c6794eccb03db5c41

Observation 02a95ecd-77eb-4bc1-9265-743cc4e120cc · outbound

This paper cites Corruption-robust offline reinforcement learning with general function approximation.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Corruption-robust offline reinforcement learning with general function approximation

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:55.607965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:54.057000Z digest=sha256:42ead5f41f9b2466b4fab301fc4c7ef0e9e6d03d0addbc36a24f465fc5711793

Observation b9ecdb87-ee50-4795-8257-fb15e3942fd9 · outbound

This paper cites Robust Reinforcement Learning on State Observations with Learned Optimal Adversary.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Robust Reinforcement Learning on State Observations with Learned Optimal Adversary

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:54.213230Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:54.213230Z digest=sha256:114b96426d05a0945ccc34424ab834085c78b78d44dfe1bba2c6aeff942cb4e5

Observation 5871579f-6a8d-4d36-901e-99fe7a7e3c0c · outbound

This paper cites Robust deep reinforcement learning against adversarial perturbations on state observa- tions.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Robust deep reinforcement learning against adversarial perturbations on state observa- tions

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:55.473965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:54.309588Z digest=sha256:d82edfb29e30fc096c8d93b96dbd6df3b250a935689c144960621c09c2cf19f0

Observation 3eac0b00-c5a7-4c4f-bb3a-438918897dbf · outbound

This paper cites medium-replay- v2.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning medium-replay- v2

Reference 43

Resolution
malformed identifier
raw_fallback, observed 2026-08-07T12:55:55.236937Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:55:54.416203Z digest=sha256:729d7433f9a3bf74a0d0517c4f661da00a9cb803f0fdce48a994bba7b596f1f0

Pith citing papers

Observation a4d3b03d-0631-4e30-a768-51c4b3a89431 · inbound

Ambient Diffusion Omni: Training Good Models with Bad Data cites this paper.

Ambient Diffusion Omni: Training Good Models with Bad Data ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning

Reference 45

Resolution
verified exact
local_arxiv, observed 2026-08-07T05:01:17.604728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T05:01:15.443445Z digest=sha256:540672372855bd6808a2179d11f57b7337af9148096d82321f47243f4a2295f2