Pith. sign in

Paper Citation Record · LEDGER

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?

As of 10 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2507.10174.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.10174 v1

Coverage vector

measured 25 of 25 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T17:42:27.411920Z

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

25 of 25 outbound references displayed

  • verified exact1
  • verified fuzzy19
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation dbc15585-d58c-4e5a-a0e4-f9a187977dd9 · outbound

This paper cites Bhargava, S.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Bhargava, S

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.738241Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.149015Z digest=sha256:f30a3e856b0401d4875fb8a59cb1bca7354bb777c200bd78f9a5a1499159091f

Observation 31d93aa1-c042-4bcc-8421-f0c211f82ad6 · outbound

This paper cites Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.722222Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.206025Z digest=sha256:7e0cf7cdd4ebe117711d41ba11d97f51c35b677901576c8e39d9e79dc3352917

Observation 5a73efac-3a6a-47e5-a043-c0262fefa2c5 · outbound

This paper cites an unresolved cited work.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T17:42:29.704959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.279527Z digest=sha256:8f621c7f85dfdcef98b260215ed3dcd2b9440671b7337892901e0f0986016134

Observation 7f58d721-7ad8-4922-9109-4ea5702c998a · outbound

This paper cites RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.689576Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.375372Z digest=sha256:5f1c6136c115f0c9e73d0eff5ca0178a910e51f3361535732c656cc3718f43c0

Observation ec031408-03dc-4c7c-a2b4-e955710b52ad · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:25.451565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:25.451565Z digest=sha256:7c4e0e3cd7443706a3cf0e0c2286753f4c4745377f0ad7e0093f3d9d1a1fd431

Observation e47883e8-a3c2-4d0b-aa3d-0caeeb910645 · outbound

This paper cites Generalized decision transformer for offline hindsight information matching.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Generalized decision transformer for offline hindsight information matching

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.673067Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.535696Z digest=sha256:cd8155de5b8e254cdab3b7e8c05214064abe37ce18ff62925e4a09b32fcaa931

Observation 4ef54741-ec1f-42e3-a52a-34a18a81a9a1 · outbound

This paper cites Instruction-driven history-aware policies for robotic manipulations.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Instruction-driven history-aware policies for robotic manipulations

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.657960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.640038Z digest=sha256:8237be9771324d7d73cc841243aa54c70b0d81aac953c581cad9eea2e66100af

Observation 0bc8c67b-1b22-479d-b29e-4d3b65f580fb · outbound

This paper cites Graph Decision Transformer.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Graph Decision Transformer

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-06T17:42:27.767178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.721552Z digest=sha256:cdfa572fcf673f1cc1d8c23b2ddfc7c18024166b5df5cfd437057014ed23ea2a

Observation efcfa5f3-79e9-4e65-930e-b873ba4f623c · outbound

This paper cites Q-value regularized transformer for offline reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-value regularized transformer for offline reinforcement learning

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.642825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.780542Z digest=sha256:11c9de1eb792fc36e17477ce8cd85c958b351fbf87b1ead0be58d3059753138b

Observation 088c834f-0f9f-4a8a-9fe5-0c725dd7329a · outbound

This paper cites Janner, Q.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Janner, Q

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.627010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.875737Z digest=sha256:cd328381de5a800182a7dc6f45171c90b9a97d3366fbf5db61ab4b6b34652fee

Observation 08ae6021-c678-4d94-8280-2d51ca1d817b · outbound

This paper cites Kumar, A.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Kumar, A

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.608950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.943789Z digest=sha256:dabb5655688bfb3cdfd63ccb1ccee6b070918d09b84a4a4f346879172cc29b4a

Observation 171cd69c-06aa-4efc-93cf-176c9a118167 · outbound

This paper cites Pre-trained language models for interactive decision-making.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Pre-trained language models for interactive decision-making

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.593244Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.015215Z digest=sha256:c32a82519d8cb8f8563626a5bf363de075bdf205b6aa047bce978d0947beaaa0

Observation cf874310-516d-41b6-ada4-ea9f5308f1d0 · outbound

This paper cites A survey on transformers in reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? A survey on transformers in reinforcement learning

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.576712Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.094983Z digest=sha256:dd50ed115a2d091c646f1f40619e2d2a6000428c67e7047f11e181a605d41756

Observation 641db10f-ae80-450f-bdac-359902819666 · outbound

This paper cites What matters in learning from offline human demonstrations for robot manipulation.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? What matters in learning from offline human demonstrations for robot manipulation

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.562118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.161012Z digest=sha256:98c5d328336c85d8667759a463d719c0a9f52b60ead2d9ab099c763c5e0c3e9f

Observation bb5e84e9-87bb-4d0a-affc-d263cece530e · outbound

This paper cites Stabilizing transformers for reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Stabilizing transformers for reinforcement learning

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.544626Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.256502Z digest=sha256:e6efa464361f6d5ddd64925ca7030980cefbc175c8892bb4aadc094a947d32b5

Observation 7a6e986d-fc7b-4212-aa8d-04fd4e946465 · outbound

This paper cites You can’t count on luck: Why decision transformers and rvs fail in stochastic environments.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? You can’t count on luck: Why decision transformers and rvs fail in stochastic environments

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.528256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.329261Z digest=sha256:efd5255ad4e89172ad8ae464bf4f1e4c0f345afe77329d585e75a0d45a494170

Observation 9fb593fa-9457-4019-8ac4-f50b52d6e8d8 · outbound

This paper cites an unresolved cited work.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T17:42:29.512678Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.435256Z digest=sha256:f9468af12ab665bacece641c7900c49e15ed8e63d3151150a067f54d3f7464f5

Observation 0dd13ca9-b91c-4e5c-8f73-15c92ba8be4e · outbound

This paper cites The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.496764Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.447168Z digest=sha256:ac1e61d6f5469be95b1ee91c941fb1f1e52fbfe806d5e51c514d4f7d5566adbb

Observation 58da4b59-b99f-40b8-abcd-56462b70d50c · outbound

This paper cites CORL : Research-oriented deep offline reinforcement learning library.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? CORL : Research-oriented deep offline reinforcement learning library

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.478645Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.512755Z digest=sha256:d3a7e980344840bf92798f3ee57f2195d39ab245a0894d818cf67e6d9e58a434

Observation 9380dfbe-915e-420e-8ac7-98ea048683a5 · outbound

This paper cites Vaswani, N.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Vaswani, N

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.340003Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.676689Z digest=sha256:1ec9bd4f2c63e2d8056c61bc44475c458f0f4e34c5cb421c4e824c63fe59e9e1

Observation aede287f-7bda-48c5-94b4-2f4aeceb1295 · outbound

This paper cites Bootstrapped transformer for offline reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Bootstrapped transformer for offline reinforcement learning

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.931143Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.793463Z digest=sha256:5389d2358b224412224c6290d3bbb202d91104585744e85e7c5f4f9f6e80ba8e

Observation 75a474c1-d5e6-45f3-90de-f9c1df2c31fe · outbound

This paper cites Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.594866Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.945947Z digest=sha256:28b2a06efab56884b18cd16b1f4d34f29d93efe08e49e025f64777c35a40e685

Observation d4cd0e3f-4e41-4c86-b79d-a1e053e281c4 · outbound

This paper cites robosuite: A Modular Simulation Framework and Benchmark for Robot Learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? robosuite: A Modular Simulation Framework and Benchmark for Robot Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:27.045068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:27.045068Z digest=sha256:4bc26a02e49798a054e2108afb58a65d9f6c32d09ad7b2aeb921c8f82d6db626

Observation d4345cf4-a529-412b-8170-5051cfd2d355 · outbound

This paper cites Robosuite environments documentation.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Robosuite environments documentation

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.171415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-08-06T17:42:27.201794Z digest=sha256:ac3a10f129929a5748bfe03879d53285a879fdbc155bd7813ebd6c99517ca6c1

Observation 7e72b31b-b612-4508-9cd0-b8cc4a2c8700 · outbound

This paper cites write newline.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? write newline

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:27.411920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:27.411920Z digest=sha256:7658da78898dbc7cb5355fb3b5b6c2543dc0c0e2795656efca21151a1334cf99

Pith citing papers

No inbound Pith citation observations are available.