Pith. sign in

Paper Citation Record · LEDGER

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?

As of 23 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2507.10174.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.10174 v1

Coverage vector

measured 25 of 25 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T17:42:27.411920Z

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

25 of 25 outbound references displayed

  • verified exact1
  • verified fuzzy19
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation dbc15585-d58c-4e5a-a0e4-f9a187977dd9 · outbound

This paper cites Bhargava, S.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Bhargava, S

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.738241Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.149015Z digest=sha256:3b767314cdc73f1db4d0b74ac07fcbfb7b22010754e4009dc9d096e35ffaabfd

Observation 31d93aa1-c042-4bcc-8421-f0c211f82ad6 · outbound

This paper cites Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.722222Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.206025Z digest=sha256:7cfa42d14acd4d4666a3cbc31d70205f6f03493bc877b6d4945e6815c62dcebd

Observation 5a73efac-3a6a-47e5-a043-c0262fefa2c5 · outbound

This paper cites an unresolved cited work.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T17:42:29.704959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.279527Z digest=sha256:c4a8c67583c41f04fd8117a78335b4480bf42e42af2a11af0ab12635620d490a

Observation 7f58d721-7ad8-4922-9109-4ea5702c998a · outbound

This paper cites RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.689576Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.375372Z digest=sha256:9a67a4754e49f8888a45e308865f139abbd7eaf87781ee96cc0c9e097ee34275

Observation ec031408-03dc-4c7c-a2b4-e955710b52ad · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:25.451565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:25.451565Z digest=sha256:20a6c6b52016bd969791a56877d61153df7e867282feb7f4e4e4080ff4986290

Observation e47883e8-a3c2-4d0b-aa3d-0caeeb910645 · outbound

This paper cites Generalized decision transformer for offline hindsight information matching.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Generalized decision transformer for offline hindsight information matching

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.673067Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.535696Z digest=sha256:8fc70a4b9dec2e45b322ee5c213e0a00f74f9a6930adf4d242b69fa1c0114862

Observation 4ef54741-ec1f-42e3-a52a-34a18a81a9a1 · outbound

This paper cites Instruction-driven history-aware policies for robotic manipulations.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Instruction-driven history-aware policies for robotic manipulations

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.657960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.640038Z digest=sha256:896c53c2717c88433cfcccef87d0df4bfdd69bead8006a2e7e0f5cac4674b81f

Observation 0bc8c67b-1b22-479d-b29e-4d3b65f580fb · outbound

This paper cites Graph Decision Transformer.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Graph Decision Transformer

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-06T17:42:27.767178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.721552Z digest=sha256:47ad5a8550ae5da1a5246333795f6cdf93bce9ebf8553658bd2b3ceea98b7941

Observation efcfa5f3-79e9-4e65-930e-b873ba4f623c · outbound

This paper cites Q-value regularized transformer for offline reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-value regularized transformer for offline reinforcement learning

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.642825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.780542Z digest=sha256:a442d96af0390961df4419eaa74bf8d0a2179aa7afe4738de0254742d7e1a3c2

Observation 088c834f-0f9f-4a8a-9fe5-0c725dd7329a · outbound

This paper cites Janner, Q.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Janner, Q

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.627010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.875737Z digest=sha256:4e41400f69ee314485ed92af5c777380e9ff4b0dbb029c481d22917221f19183

Observation 08ae6021-c678-4d94-8280-2d51ca1d817b · outbound

This paper cites Kumar, A.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Kumar, A

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.608950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:25.943789Z digest=sha256:31b923d93a573ea3e964f5665c39086c2a0a595d8f0f3e517e0fbc5ba578e5a1

Observation 171cd69c-06aa-4efc-93cf-176c9a118167 · outbound

This paper cites Pre-trained language models for interactive decision-making.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Pre-trained language models for interactive decision-making

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.593244Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.015215Z digest=sha256:c04798cef1450bbd2ed6793757e0880ab05dd5014c92d3230dbe6787db596a8c

Observation cf874310-516d-41b6-ada4-ea9f5308f1d0 · outbound

This paper cites A survey on transformers in reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? A survey on transformers in reinforcement learning

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.576712Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.094983Z digest=sha256:0e19e029447336cb03a4cceea94973e33852d92a3e7290d85783b3181a2255b3

Observation 641db10f-ae80-450f-bdac-359902819666 · outbound

This paper cites What matters in learning from offline human demonstrations for robot manipulation.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? What matters in learning from offline human demonstrations for robot manipulation

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.562118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.161012Z digest=sha256:d1fa9df3dc3a40db313ceb28b71fc6ea10964a0dcac6218bec9a08fa4d059832

Observation bb5e84e9-87bb-4d0a-affc-d263cece530e · outbound

This paper cites Stabilizing transformers for reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Stabilizing transformers for reinforcement learning

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.544626Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.256502Z digest=sha256:3ab026b16ed8e5b9d13bad12c06b9d3e577179a5bee5bb8286a44867608f3cd4

Observation 7a6e986d-fc7b-4212-aa8d-04fd4e946465 · outbound

This paper cites You can’t count on luck: Why decision transformers and rvs fail in stochastic environments.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? You can’t count on luck: Why decision transformers and rvs fail in stochastic environments

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.528256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.329261Z digest=sha256:d4fd3bb506f4a39d5ddb7df78bb8cf01bc37052dfe4c96cec3a4d1f5c6305bc8

Observation 9fb593fa-9457-4019-8ac4-f50b52d6e8d8 · outbound

This paper cites an unresolved cited work.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T17:42:29.512678Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.435256Z digest=sha256:9efa529b56cccd46d503def750fe68c7ebf5afd543a8a375b6f6838c92510bb5

Observation 0dd13ca9-b91c-4e5c-8f73-15c92ba8be4e · outbound

This paper cites The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.496764Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.447168Z digest=sha256:9cd0c276bd533d2b02059c89afcf79183d147157934eb82782c18f97d1714559

Observation 58da4b59-b99f-40b8-abcd-56462b70d50c · outbound

This paper cites CORL : Research-oriented deep offline reinforcement learning library.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? CORL : Research-oriented deep offline reinforcement learning library

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.478645Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.512755Z digest=sha256:472bd6894314c4ed690aa1fcd3d4a7b6c0bfa14b50df1ffb6b3b980542239df1

Observation 9380dfbe-915e-420e-8ac7-98ea048683a5 · outbound

This paper cites Vaswani, N.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Vaswani, N

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:29.340003Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.676689Z digest=sha256:170a81ed526225b1a063ae1140b2c8846e761a60dd45fc1e9c9536b8c786eff5

Observation aede287f-7bda-48c5-94b4-2f4aeceb1295 · outbound

This paper cites Bootstrapped transformer for offline reinforcement learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Bootstrapped transformer for offline reinforcement learning

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.931143Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.793463Z digest=sha256:5fbf63ae9538ef649766e7a356e7ff4ae112ba212faf901900017908a62b9cf9

Observation 75a474c1-d5e6-45f3-90de-f9c1df2c31fe · outbound

This paper cites Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.594866Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:26.945947Z digest=sha256:60963d51e313f0d91e7133511f06de1917630add2710f739f52b22fda48a58e0

Observation d4cd0e3f-4e41-4c86-b79d-a1e053e281c4 · outbound

This paper cites robosuite: A Modular Simulation Framework and Benchmark for Robot Learning.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? robosuite: A Modular Simulation Framework and Benchmark for Robot Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:27.045068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:27.045068Z digest=sha256:c60c214769d89ac493d12141b1c14f2f1fac770e287f6e1a8f5279f0a08bff18

Observation d4345cf4-a529-412b-8170-5051cfd2d355 · outbound

This paper cites Robosuite environments documentation.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? Robosuite environments documentation

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T17:42:28.171415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-08-06T17:42:27.201794Z digest=sha256:b12096762856a23a96657ae9cb56092424bb712b2147df5d352cfa3ec83e2321

Observation 7e72b31b-b612-4508-9cd0-b8cc4a2c8700 · outbound

This paper cites write newline.

Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning? write newline

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T17:42:27.411920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:42:27.411920Z digest=sha256:b39c7c5dca4ddf14477cee40ec187754d7a60d6c88a289ef4aa7ab65f1a7fe2b

Pith citing papers

No inbound Pith citation observations are available.