Pith. sign in

Paper Citation Record · LEDGER

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?

As of 8 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2507.10174.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.10174 v1

Coverage vector

measured 25 of 25 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T17:42:27.411920Z

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

25 of 25 outbound references displayed

  • verified exact1
  • verified fuzzy19
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation dbc15585-d58c-4e5a-a0e4-f9a187977dd9 · outbound

This paper cites Bhargava, S.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Bhargava, S

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.738241Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.149015Z digest=sha256:8ab5ec15de64a3bb041858f1511fe6469e8e9c6160dd3ce422e11a6f18475a59

Observation 31d93aa1-c042-4bcc-8421-f0c211f82ad6 · outbound

This paper cites Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.722222Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.206025Z digest=sha256:0103044a8a996c4211e462b8d3c6828d9f702788677d8d4cf1e2c27d447bf6aa

Observation 5a73efac-3a6a-47e5-a043-c0262fefa2c5 · outbound

This paper cites an unresolved cited work.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T17:42:29.704959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.279527Z digest=sha256:135d08a4d42dcb0fa59a8685e9738766763c163475eeab315aeca638b42020a5

Observation 7f58d721-7ad8-4922-9109-4ea5702c998a · outbound

This paper cites RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.689576Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.375372Z digest=sha256:734fa1fc5dd5045089e5163e311284d6a8e5c52822490323284abaf4507bb496

Observation ec031408-03dc-4c7c-a2b4-e955710b52ad · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:25.451565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:25.451565Z digest=sha256:0848610372d18a895d7e549f85f981e8e3956e8c4c08c5e5d871108c9ea4c850

Observation e47883e8-a3c2-4d0b-aa3d-0caeeb910645 · outbound

This paper cites Generalized decision transformer for offline hindsight information matching.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Generalized decision transformer for offline hindsight information matching

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.673067Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.535696Z digest=sha256:be01caeab9b8e93ee465aecd74b1c360cb4d4b0936c322b26c64c6b74cd6ef62

Observation 4ef54741-ec1f-42e3-a52a-34a18a81a9a1 · outbound

This paper cites Instruction-driven history-aware policies for robotic manipulations.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Instruction-driven history-aware policies for robotic manipulations

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.657960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.640038Z digest=sha256:3cbfa7cc041a8deb959dee95e0535aaa21d8b0c0838ff068900e71a9c50f81bb

Observation 0bc8c67b-1b22-479d-b29e-4d3b65f580fb · outbound

This paper cites Graph Decision Transformer.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Graph Decision Transformer

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-06T17:42:27.767178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.721552Z digest=sha256:233c83f9f02ef50ec450b65956c1fb6df9c7d8b0df16f5d7f3cd557cf5d3d7cd

Observation efcfa5f3-79e9-4e65-930e-b873ba4f623c · outbound

This paper cites Q-value regularized transformer for offline reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-value regularized transformer for offline reinforcement learning

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.642825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.780542Z digest=sha256:9dcf0cb760e4f43bb096c05415a834bb01681d122f4943b7d44cb04373623610

Observation 088c834f-0f9f-4a8a-9fe5-0c725dd7329a · outbound

This paper cites Janner, Q.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Janner, Q

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.627010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.875737Z digest=sha256:6c51540c0481290d8fc97637399666522ab697e46aa42aaf03c0e33bcf6c0c56

Observation 08ae6021-c678-4d94-8280-2d51ca1d817b · outbound

This paper cites Kumar, A.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Kumar, A

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.608950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.943789Z digest=sha256:7924cce6eb87f25f67d47581dfc3a1a0d38eb930b01f6355639f5b6a324548b9

Observation 171cd69c-06aa-4efc-93cf-176c9a118167 · outbound

This paper cites Pre-trained language models for interactive decision-making.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Pre-trained language models for interactive decision-making

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.593244Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.015215Z digest=sha256:10077edc556c73ac3fccd9a2e4bea543afa55d734064a34a12a1f5ef52849534

Observation cf874310-516d-41b6-ada4-ea9f5308f1d0 · outbound

This paper cites A survey on transformers in reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? A survey on transformers in reinforcement learning

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.576712Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.094983Z digest=sha256:1ec16350c86d8a1a00c08fda948510434890979493fcc1ba1265cc9cba50ee1b

Observation 641db10f-ae80-450f-bdac-359902819666 · outbound

This paper cites What matters in learning from offline human demonstrations for robot manipulation.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? What matters in learning from offline human demonstrations for robot manipulation

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.562118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.161012Z digest=sha256:0366f875f64a4551b5c3e9d9d979b537be3f2694b9c8c0ec20885dd7ed40a708

Observation bb5e84e9-87bb-4d0a-affc-d263cece530e · outbound

This paper cites Stabilizing transformers for reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Stabilizing transformers for reinforcement learning

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.544626Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.256502Z digest=sha256:529898353e7ec9ca8d15b3bf844cf027cd8907eea47586ba770722acd87c9df4

Observation 7a6e986d-fc7b-4212-aa8d-04fd4e946465 · outbound

This paper cites You can’t count on luck: Why decision transformers and rvs fail in stochastic environments.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? You can’t count on luck: Why decision transformers and rvs fail in stochastic environments

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.528256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.329261Z digest=sha256:043afcd4845a78723a45f15f963f5b9cf7992ebc0dba30f16ebcbe28a1d7090a

Observation 9fb593fa-9457-4019-8ac4-f50b52d6e8d8 · outbound

This paper cites an unresolved cited work.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T17:42:29.512678Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.435256Z digest=sha256:29ae1c289035ea8370189db8dfd4a3eb400a03a1bd8aa1cc3815d39dcc07914c

Observation 0dd13ca9-b91c-4e5c-8f73-15c92ba8be4e · outbound

This paper cites The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.496764Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.447168Z digest=sha256:901c87f943870fb934f09c8ec796dddbdd1339e556b525e44ab44db9b5f5dbcd

Observation 58da4b59-b99f-40b8-abcd-56462b70d50c · outbound

This paper cites CORL : Research-oriented deep offline reinforcement learning library.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? CORL : Research-oriented deep offline reinforcement learning library

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.478645Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.512755Z digest=sha256:ced9e7990349b6704489bdcd15dcac6b2427cc9d3532df4a6f630a14e00267e6

Observation 9380dfbe-915e-420e-8ac7-98ea048683a5 · outbound

This paper cites Vaswani, N.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Vaswani, N

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.340003Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.676689Z digest=sha256:f7acd70c01a9e1f69fff9f4d5147c62ddbe4df6a8e3f289c166e7afdfc93c87a

Observation aede287f-7bda-48c5-94b4-2f4aeceb1295 · outbound

This paper cites Bootstrapped transformer for offline reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Bootstrapped transformer for offline reinforcement learning

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.931143Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.793463Z digest=sha256:0d2d9d138a2b122d91efb6d01ffbd21ca3e475474225c9659373a310b7b5925e

Observation 75a474c1-d5e6-45f3-90de-f9c1df2c31fe · outbound

This paper cites Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.594866Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.945947Z digest=sha256:b6a06ae6de37fbbe69feb157b9f01457af9661dafe23ee6f3862f100c74f6e11

Observation d4cd0e3f-4e41-4c86-b79d-a1e053e281c4 · outbound

This paper cites robosuite: A Modular Simulation Framework and Benchmark for Robot Learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? robosuite: A Modular Simulation Framework and Benchmark for Robot Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:27.045068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:27.045068Z digest=sha256:0dba8b1335f9eb7907837abe656299f364ed7300e3636e3ddad0da9b6954b0f3

Observation d4345cf4-a529-412b-8170-5051cfd2d355 · outbound

This paper cites Robosuite environments documentation.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Robosuite environments documentation

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.171415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-06T17:42:27.201794Z digest=sha256:d1daf9669d4d0f0ec48d56a33edea58f992c92e5c81e513011ce91605c129f85

Observation 7e72b31b-b612-4508-9cd0-b8cc4a2c8700 · outbound

This paper cites write newline.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? write newline

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:27.411920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:27.411920Z digest=sha256:5f827a1cbbd9bb22cdf7fdf9c79051cd0c6eddc1bf7976c76d6c8c5182158699

Pith citing papers

No inbound Pith citation observations are available.