Pith. sign in

Paper Citation Record · LEDGER

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?

As of 18 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2507.10174.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.10174 v1

Coverage vector

measured 25 of 25 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T17:42:27.411920Z

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

25 of 25 outbound references displayed

  • verified exact1
  • verified fuzzy19
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation dbc15585-d58c-4e5a-a0e4-f9a187977dd9 · outbound

This paper cites Bhargava, S.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Bhargava, S

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.738241Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.149015Z digest=sha256:60358bcaa360ed64c9c9d576ad0072b70cf351812db7728b63061bde186c787f

Observation 31d93aa1-c042-4bcc-8421-f0c211f82ad6 · outbound

This paper cites Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.722222Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.206025Z digest=sha256:10d57751ead6b98553d213392bb37804a1b330e8bcfed19db407bc9f5fa0e620

Observation 5a73efac-3a6a-47e5-a043-c0262fefa2c5 · outbound

This paper cites an unresolved cited work.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T17:42:29.704959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.279527Z digest=sha256:8bfd770d368316b4a22b0a27bdab7b012df9deb1974359d2e1609ccfe8151b68

Observation 7f58d721-7ad8-4922-9109-4ea5702c998a · outbound

This paper cites RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.689576Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.375372Z digest=sha256:0b32ccfb7c5e7321ff7bad431fba4f8fc7bdbdf75d7ba9e45d71115bebf07ce3

Observation ec031408-03dc-4c7c-a2b4-e955710b52ad · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:25.451565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:25.451565Z digest=sha256:117f69c47fbaeff877dbf495e7a9ac9403c31f74cd740e8692f417efbf46a5f7

Observation e47883e8-a3c2-4d0b-aa3d-0caeeb910645 · outbound

This paper cites Generalized decision transformer for offline hindsight information matching.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Generalized decision transformer for offline hindsight information matching

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.673067Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.535696Z digest=sha256:cf5423f2523e93c4bc447458d6d6051eb466e3088f65e94e9b224743f5b1811e

Observation 4ef54741-ec1f-42e3-a52a-34a18a81a9a1 · outbound

This paper cites Instruction-driven history-aware policies for robotic manipulations.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Instruction-driven history-aware policies for robotic manipulations

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.657960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.640038Z digest=sha256:c85e5fe9e4e853c1733e45fac792f9e53e064089af5953edb896e8c512c92666

Observation 0bc8c67b-1b22-479d-b29e-4d3b65f580fb · outbound

This paper cites Graph Decision Transformer.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Graph Decision Transformer

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-06T17:42:27.767178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.721552Z digest=sha256:62071d7aae009f6aacd3b3ac12257296283e483878ab2845513824dcd29a8fa8

Observation efcfa5f3-79e9-4e65-930e-b873ba4f623c · outbound

This paper cites Q-value regularized transformer for offline reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-value regularized transformer for offline reinforcement learning

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.642825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.780542Z digest=sha256:6439d8cec5a1f24dd3605f24ade4ef47bb94b7e0abd5e20d6ad67e1e0e989f68

Observation 088c834f-0f9f-4a8a-9fe5-0c725dd7329a · outbound

This paper cites Janner, Q.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Janner, Q

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.627010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.875737Z digest=sha256:0e64a60e23b7a0958978e760243bf205dae46a1f997ed676b3908f3d950eab30

Observation 08ae6021-c678-4d94-8280-2d51ca1d817b · outbound

This paper cites Kumar, A.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Kumar, A

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.608950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.943789Z digest=sha256:6a882f971a344f73682ce24a1ec2aa08cf945584b9626d03cdf4c7689754d524

Observation 171cd69c-06aa-4efc-93cf-176c9a118167 · outbound

This paper cites Pre-trained language models for interactive decision-making.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Pre-trained language models for interactive decision-making

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.593244Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.015215Z digest=sha256:d209756028c2580c9307af49c95e765679e8b7bca130727e0ae2f9f7bd51c73b

Observation cf874310-516d-41b6-ada4-ea9f5308f1d0 · outbound

This paper cites A survey on transformers in reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? A survey on transformers in reinforcement learning

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.576712Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.094983Z digest=sha256:e3040011aa8dc2e7c9d7abb6ef3d6f313831878f6643a7283a3c34987df680bb

Observation 641db10f-ae80-450f-bdac-359902819666 · outbound

This paper cites What matters in learning from offline human demonstrations for robot manipulation.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? What matters in learning from offline human demonstrations for robot manipulation

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.562118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.161012Z digest=sha256:9203367ed6293bbead5375bd561abac379d4cf95a346cd533867e60407f6b670

Observation bb5e84e9-87bb-4d0a-affc-d263cece530e · outbound

This paper cites Stabilizing transformers for reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Stabilizing transformers for reinforcement learning

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.544626Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.256502Z digest=sha256:8dc94af31fc8e38150908031c686fa8224850e54e0062f325096529115f5db8a

Observation 7a6e986d-fc7b-4212-aa8d-04fd4e946465 · outbound

This paper cites You can’t count on luck: Why decision transformers and rvs fail in stochastic environments.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? You can’t count on luck: Why decision transformers and rvs fail in stochastic environments

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.528256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.329261Z digest=sha256:dceda5ed77dc3c68c09513d85db7ce2b3576a54b6fcadc956f58f37b78ae6e92

Observation 9fb593fa-9457-4019-8ac4-f50b52d6e8d8 · outbound

This paper cites an unresolved cited work.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T17:42:29.512678Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.435256Z digest=sha256:60f55e651347640e9a1531f315fa8995e330ce65b126ad693cb6880d4469224c

Observation 0dd13ca9-b91c-4e5c-8f73-15c92ba8be4e · outbound

This paper cites The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.496764Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.447168Z digest=sha256:bd831300877ce9d4e45180551ca2f420ccf3a6d0cab471ed810ad7a1dabbcb68

Observation 58da4b59-b99f-40b8-abcd-56462b70d50c · outbound

This paper cites CORL : Research-oriented deep offline reinforcement learning library.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? CORL : Research-oriented deep offline reinforcement learning library

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.478645Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.512755Z digest=sha256:652514e1d19b0098961202e7a2e5af049be06313ff4f71432537e40c3e281b62

Observation 9380dfbe-915e-420e-8ac7-98ea048683a5 · outbound

This paper cites Vaswani, N.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Vaswani, N

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.340003Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.676689Z digest=sha256:67f5948dc4154c4ce48725c886973fbe87e54181e25dc4259107771940b2f0fd

Observation aede287f-7bda-48c5-94b4-2f4aeceb1295 · outbound

This paper cites Bootstrapped transformer for offline reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Bootstrapped transformer for offline reinforcement learning

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.931143Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.793463Z digest=sha256:941125cc8565e42b619d7697c46e55a1266a2e721979cb371b81d23970c8b412

Observation 75a474c1-d5e6-45f3-90de-f9c1df2c31fe · outbound

This paper cites Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.594866Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.945947Z digest=sha256:ef7781b217f09b69b91b35b3cded9692c49958e3693bf6f74d2c626380ecc8f3

Observation d4cd0e3f-4e41-4c86-b79d-a1e053e281c4 · outbound

This paper cites robosuite: A Modular Simulation Framework and Benchmark for Robot Learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? robosuite: A Modular Simulation Framework and Benchmark for Robot Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:27.045068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:27.045068Z digest=sha256:38ef3c1c19710ad465bcb230464b73ce26d255d4e2844a6fefda5f16240461d7

Observation d4345cf4-a529-412b-8170-5051cfd2d355 · outbound

This paper cites Robosuite environments documentation.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Robosuite environments documentation

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.171415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T17:42:27.201794Z digest=sha256:edacdb12c18790e58a22c162ff6c7b481abfbd25beda5b3917c1cb81c00a17f5

Observation 7e72b31b-b612-4508-9cd0-b8cc4a2c8700 · outbound

This paper cites write newline.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? write newline

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:27.411920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:27.411920Z digest=sha256:59b4a18d752df0d2d4f7d9b606ff2eb7c704e2d4d62c222522566643fb63c839

Pith citing papers

No inbound Pith citation observations are available.