Pith. sign in

Paper Citation Record · LEDGER

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning

As of 14 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2509.00347.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2509.00347 v1

Coverage vector

measured 15 of 15 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-05T13:46:03.231288Z

measured 15 of 15 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

15 of 15 outbound references displayed

  • verified exact3
  • verified fuzzy3
  • unresolved9
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation cddb5748-84c8-4599-8a79-66bcf1635332 · outbound

This paper cites Is Conditional Generative Modeling all you need for Decision-Making?.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Is Conditional Generative Modeling all you need for Decision-Making?

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.217620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.217620Z digest=sha256:deee405cdf2878002e5f7bd3f1525c93c616c832b3e90ba41b9871dd1c218b66

Observation fd1ace3d-5848-43db-8f71-c981711f80bb · outbound

This paper cites Planning with Diffusion for Flexible Behavior Synthesis.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Planning with Diffusion for Flexible Behavior Synthesis

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.350406Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.350406Z digest=sha256:0fe102a1936e042aeca8b19eb20316106fa312e2ad1a918f83a9bd69ea55d954

Observation 4a5fffbe-172a-45b3-8c98-208015532ea9 · outbound

This paper cites Ad4rl: Autonomous driving benchmarks for of- fline reinforcement learning with value-based dataset.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Ad4rl: Autonomous driving benchmarks for of- fline reinforcement learning with value-based dataset

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T13:46:03.957230Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-05T13:46:02.387100Z digest=sha256:0390c4f79658d115f5550d127d938e7d1567c094379a92c691265d418c7bf3ca

Observation 01f8c809-2436-4020-b774-450034bef383 · outbound

This paper cites Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-08-05T13:46:03.559746Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-05T13:46:02.477661Z digest=sha256:98b38f04d55803d0831e664433c8d56d555d63eaccef53fc319d5d9576e2375a

Observation 819b1949-d086-48b9-8cad-bc5faae2c2ba · outbound

This paper cites Soft adversarial offline reinforcement learning via reducing the attack strength for generalization.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Soft adversarial offline reinforcement learning via reducing the attack strength for generalization

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T13:46:03.832525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-05T13:46:02.545337Z digest=sha256:5dace7950149f0bbb6faecd8101447eb743824f17f2120661717812a00d1ea40

Observation a3c743bb-61f6-4e56-9bbe-68086e6d8572 · outbound

This paper cites Large Language Models Meet NLP: A Survey.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Large Language Models Meet NLP: A Survey

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.642782Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.642782Z digest=sha256:3e07929f18342f9d8fab2ae61805b6992b37c0de96042f7ed224a1ea76bdeda3

Observation 69d9f2f7-0787-43bb-9a0a-8e948284061b · outbound

This paper cites Mujoco: A physics engine for model-based control.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Mujoco: A physics engine for model-based control

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T13:46:03.699111Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-05T13:46:02.910684Z digest=sha256:b703050ebd9d8ab6d3d434871ecb6bc530bdef27bcf2f98535ac4f8b5572ca9b

Observation 08620d10-b74b-4347-b5fd-b48fc279c181 · outbound

This paper cites A Survey on Knowledge Distillation of Large Language Models.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning A Survey on Knowledge Distillation of Large Language Models

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:03.161222Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:03.161222Z digest=sha256:81f95f9d1f2cb274fba97eec7cb2093f908e81a92225458939bc18e17a74512a

Observation ea991915-d6c7-4e22-a76d-27ddd1176e20 · outbound

This paper cites Generalization of Reinforcement Learning with Policy-Aware Adversarial Data Augmentation.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Generalization of Reinforcement Learning with Policy-Aware Adversarial Data Augmentation

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-08-05T13:46:03.459519Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-05T13:46:03.192637Z digest=sha256:cbe647877948193e2795e4be4002e6f863d450ea13ada5c731128d772af8c38f

Observation 4b80b5fd-0993-424f-8b9e-54b8c6fec6b1 · outbound

This paper cites Paired Open-Ended Trailblazer (POET): Endlessly Generating Increasingly Complex and Diverse Learning Environments and Their Solutions.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Paired Open-Ended Trailblazer (POET): Endlessly Generating Increasingly Complex and Diverse Learning Environments and Their Solutions

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:03.033891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:03.033891Z digest=sha256:1107d0dcee2fa3fcea0e82a8133c0697d80246ed3d48a086daac98accb7b7f62

Observation 076455a5-efce-4483-a759-dc9dd8131d7f · outbound

This paper cites OLMo: Accelerating the Science of Language Models.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning OLMo: Accelerating the Science of Language Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.328405Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.328405Z digest=sha256:4804ccfe196dd747c60cde6d3342354125645a224deab5c3a57589c81b86f7e1

Observation 2ebc30eb-88bc-4c90-a44a-bd7abe79f9f3 · outbound

This paper cites Offline Trajectory Optimization for Offline Reinforcement Learning.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Offline Trajectory Optimization for Offline Reinforcement Learning

Reference 2021

Resolution
verified exact
local_arxiv, observed 2026-08-05T13:46:03.367828Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-05T13:46:03.231288Z digest=sha256:a15f4086964732e529b180eb74630181160da1acf3c8aae83db9d562f2d102a8

Observation fabc8d4a-808d-47a5-a9f6-17af5f205a5f · outbound

This paper cites LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.788254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.788254Z digest=sha256:68e7d1b11e98784a238ccd2126583d215345fb2c58b6e18eb5cbc35e46a9ee3c

Observation d4fabd4e-6e44-4eda-aa65-79ad9c01bfdd · outbound

This paper cites The Llama 3 Herd of Models.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning The Llama 3 Herd of Models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.269056Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.269056Z digest=sha256:043f515d89b8c51bc8e8af7e048b6bf73238302014fcb3b8d08e4148a5d19142

Observation 4d68f3ad-e4fc-40e6-be86-ce3a31ed6f15 · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.304215Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.304215Z digest=sha256:170c42b771d1e7e28175201934870e4d6f3160af80b0cbedc658626d69fbbee8

Pith citing papers

No inbound Pith citation observations are available.