{"as_of":"2026-08-10T15:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d7e104bbecd5e3d7c32a17425f3a1fd18b00cd7d6545bd1eaca9102697d27173","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:42:27.411920Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10174/citation-record","integrity":"/paper/2507.10174/integrity","json":"/paper/2507.10174/citation-record.json","paper":"/paper/2507.10174"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.733119Z","title":"Bhargava, S","venue":null,"work_id":"be8f115c-98a7-473f-b3e2-0715370969cf","year":2024},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.149015Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:caa59ccd7851c768143bf60e91ff8d226b00269446facfe14c356d47fc3512c4","observation_id":"dbc15585-d58c-4e5a-a0e4-f9a187977dd9","resolution":{"observed_at":"2026-08-06T17:42:29.738241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.717122Z","title":"Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions","venue":null,"work_id":"2ffe9b89-d153-4ec7-aaa7-112e6eb4ffba","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.206025Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:6d1e89f1a45036399aa72cc52e1ae9ace7b58b0ef551706705261bb625bfa135","observation_id":"31d93aa1-c042-4bcc-8421-f0c211f82ad6","resolution":{"observed_at":"2026-08-06T17:42:29.722222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.700174Z","title":null,"venue":null,"work_id":"6f8d7c81-c761-4fa6-9c2d-ef5a40b3fbb4","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.279527Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:d01f8fc6e4e0401701d61a73a5785e24d953edfdf43834bb3e342b4bf030b69f","observation_id":"5a73efac-3a6a-47e5-a043-c0262fefa2c5","resolution":{"observed_at":"2026-08-06T17:42:29.704959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.684010Z","title":"RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021","venue":null,"work_id":"22f7db1d-520a-4e20-b7fe-d43aaf3d8a7c","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.375372Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:fef9151687d8c765be31bb234ba0dcc6f80ef311ef74afa705c24009a71d9037","observation_id":"7f58d721-7ad8-4922-9109-4ea5702c998a","resolution":{"observed_at":"2026-08-06T17:42:29.689576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-06T17:42:25.451565Z","title":"D4rl: Datasets for deep data-driven reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.451565Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:168e97bcd06e00e90f23867b5ceaac8e68c85b50bb3c9ce3b34abb992d2a0a55","observation_id":"ec031408-03dc-4c7c-a2b4-e955710b52ad","resolution":{"observed_at":"2026-08-06T17:42:25.451565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.668322Z","title":"Generalized decision transformer for offline hindsight information matching","venue":null,"work_id":"bd110180-089f-489c-8629-c61b4cb10c83","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.535696Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:4dc07eea82c4c4f33a97c99cfb0e05d8c52a0003787c3481616aa92155e47a02","observation_id":"e47883e8-a3c2-4d0b-aa3d-0caeeb910645","resolution":{"observed_at":"2026-08-06T17:42:29.673067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.653262Z","title":"Instruction-driven history-aware policies for robotic manipulations","venue":null,"work_id":"e82dc81a-7e11-4164-855d-569d124d41c7","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.640038Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:d0771a58f2137567e7e0e94917b74cc6df3ccff025acc93dc2f2fdbffe436fe5","observation_id":"4ef54741-ec1f-42e3-a52a-34a18a81a9a1","resolution":{"observed_at":"2026-08-06T17:42:29.657960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03747","last_updated":"2023-03-07T09:10:34Z","snapshot_observed_at":"2026-08-08T20:14:17.721475Z","submitted_at":"2023-03-07T09:10:34Z","title":"Graph Decision Transformer","version":1},"cited_work":{"arxiv_id":"2303.03747","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.03747","snapshot_observed_at":"2026-08-06T17:42:27.669175Z","title":"Graph Decision Transformer","venue":"cs.LG","work_id":"7bf70bf2-784d-4ee8-be0d-9b8c2349e7bc","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.721552Z"},"links":{"cited_paper":"/paper/2303.03747","citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:422c54119436fbe0380175b8da9cccc537fd5f8f9015da127329194ca4c1505f","observation_id":"0bc8c67b-1b22-479d-b29e-4d3b65f580fb","resolution":{"observed_at":"2026-08-06T17:42:27.767178Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.637906Z","title":"Q-value regularized transformer for offline reinforcement learning","venue":null,"work_id":"7ac53737-a0b1-4ae8-81b6-d6a4e153b1b0","year":2024},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.780542Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:34e50fe654733604098ca29ecd7c7d581e15badb94bc58589fe56c6e58d341f1","observation_id":"efcfa5f3-79e9-4e65-930e-b873ba4f623c","resolution":{"observed_at":"2026-08-06T17:42:29.642825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.622836Z","title":"Janner, Q","venue":null,"work_id":"354addf4-6d0d-4d63-a278-b65bb58f1299","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.875737Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:a782958695c5eb9f25865569771599eeae2c9ff952139d0388a1fb6fe0ad7423","observation_id":"088c834f-0f9f-4a8a-9fe5-0c725dd7329a","resolution":{"observed_at":"2026-08-06T17:42:29.627010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.603183Z","title":"Kumar, A","venue":null,"work_id":"87b49d90-bc1d-46c7-b4a7-19b708c5c8ac","year":2020},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.943789Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:0f548e26b04b566ceccbe5064dadd4081a6d9381eb0203a3a8cd558995b7d177","observation_id":"08ae6021-c678-4d94-8280-2d51ca1d817b","resolution":{"observed_at":"2026-08-06T17:42:29.608950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.587527Z","title":"Pre-trained language models for interactive decision-making","venue":null,"work_id":"6741bd2a-f7e1-46cb-93ea-662f0a8866a8","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.015215Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:b04387947c096519eccc5c68d589a4d9f4e32a50a5ecd20b14139531d90e35d3","observation_id":"171cd69c-06aa-4efc-93cf-176c9a118167","resolution":{"observed_at":"2026-08-06T17:42:29.593244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.571891Z","title":"A survey on transformers in reinforcement learning","venue":null,"work_id":"5ec496a3-d4e9-4ad0-bc97-d9fd55e80306","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.094983Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:3ea9f9df7fe8c1bcfd49921a22b27814a95ba988d2a7aeedd47e1d8da983abdb","observation_id":"cf874310-516d-41b6-ada4-ea9f5308f1d0","resolution":{"observed_at":"2026-08-06T17:42:29.576712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.556989Z","title":"What matters in learning from offline human demonstrations for robot manipulation","venue":null,"work_id":"9bbb1f94-b44c-449e-ba2d-399f550d6194","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.161012Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:3f88b6849fb04a00a589276f64c32073571dbd456b3884796073545fdc6bcdf6","observation_id":"641db10f-ae80-450f-bdac-359902819666","resolution":{"observed_at":"2026-08-06T17:42:29.562118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.539593Z","title":"Stabilizing transformers for reinforcement learning","venue":null,"work_id":"a8d98a3b-62c8-452f-9047-5b88f5ae1507","year":2020},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.256502Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:b89fd1a1ee2431452b33e9e6c0bc5597589884a67db17a4860fb7d66fad5adf6","observation_id":"bb5e84e9-87bb-4d0a-affc-d263cece530e","resolution":{"observed_at":"2026-08-06T17:42:29.544626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.523288Z","title":"You can’t count on luck: Why decision transformers and rvs fail in stochastic environments","venue":null,"work_id":"1990bf7c-480c-423c-837e-cd579ddc32ae","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.329261Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:782b470083a74d9545b30c43eee39089ae17f21f4ab40642f0d39c6ad161bff7","observation_id":"7a6e986d-fc7b-4212-aa8d-04fd4e946465","resolution":{"observed_at":"2026-08-06T17:42:29.528256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.507865Z","title":null,"venue":null,"work_id":"f8318558-7abc-479e-b37b-37dcb2ae2ae0","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.435256Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:6477ac7d13c9c8705fa61f8249bfe44a89a20b2358fe40048d3ad88ed323cf4f","observation_id":"9fb593fa-9457-4019-8ac4-f50b52d6e8d8","resolution":{"observed_at":"2026-08-06T17:42:29.512678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.491256Z","title":"The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning","venue":null,"work_id":"0f8fc976-4283-4482-997b-8f31cebc118f","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.447168Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:fb3a1bce3d1f500dae80525a1775bb6684bb6028c340638632ae1e8431afa12b","observation_id":"0dd13ca9-b91c-4e5c-8f73-15c92ba8be4e","resolution":{"observed_at":"2026-08-06T17:42:29.496764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.473902Z","title":"CORL : Research-oriented deep offline reinforcement learning library","venue":null,"work_id":"3f953e31-f17d-4f52-a9da-a9b40f58c55c","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.512755Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:e2afa084636e955f5e839a9e0aef5ef272e268fdb41e5086ba39230dc7c2da73","observation_id":"58da4b59-b99f-40b8-abcd-56462b70d50c","resolution":{"observed_at":"2026-08-06T17:42:29.478645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.184580Z","title":"Vaswani, N","venue":null,"work_id":"15e8c3c7-fa8a-4dc0-96fe-4cd586a7ab83","year":2017},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.676689Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:ccdc5658fb67a14b99c8f9cf1afcafbd19232f1fb18e5985c29bef4a6f227e8a","observation_id":"9380dfbe-915e-420e-8ac7-98ea048683a5","resolution":{"observed_at":"2026-08-06T17:42:29.340003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:28.771330Z","title":"Bootstrapped transformer for offline reinforcement learning","venue":null,"work_id":"c2090f59-4ce6-4693-8c49-09af212e97ba","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.793463Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:6258c0f91b7a2fb68b42b16e9b7525261b61facfe9f93aedca20ad886833c46c","observation_id":"aede287f-7bda-48c5-94b4-2f4aeceb1295","resolution":{"observed_at":"2026-08-06T17:42:28.931143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:28.351704Z","title":"Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl","venue":null,"work_id":"3b954924-9575-4e26-b9ec-bbff0232d8f4","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.945947Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:cb6f097a67d64d03ff25cef8ea355a52fc271cab76e0ca10506a71e10dbdaede","observation_id":"75a474c1-d5e6-45f3-90de-f9c1df2c31fe","resolution":{"observed_at":"2026-08-06T17:42:28.594866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-06T17:42:27.045068Z","title":"Robosuite: A modular simulation framework and benchmark for robot learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:27.045068Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:8836651dccd6a5a1612d4b9193611179e0f905dda806f63466af30d4954e44e5","observation_id":"d4cd0e3f-4e41-4c86-b79d-a1e053e281c4","resolution":{"observed_at":"2026-08-06T17:42:27.045068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:27.979136Z","title":"Robosuite environments documentation","venue":null,"work_id":"46cd90ad-3df2-456d-ba59-c68058ad9ae9","year":2020},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:27.201794Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:c844bd6581053a1f3c3e84fe6f1ecf83b3c722434675ee14c5ed922ac1946e47","observation_id":"d4345cf4-a529-412b-8170-5051cfd2d355","resolution":{"observed_at":"2026-08-06T17:42:28.171415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:27.411920Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:27.411920Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:b574a62786bf3b4db570e326b69a086cc75913c0e093a87791e40e9425254975","observation_id":"7e72b31b-b612-4508-9cd0-b8cc4a2c8700","resolution":{"observed_at":"2026-08-06T17:42:27.411920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T15:12:41.513237Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":19},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2507.10174."}