{"as_of":"2026-08-09T05:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:391fdaa858fe919c583fcb73c77043e41115e22a2bf76cb1e4298514a7a9922f","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:42:27.411920Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10174/citation-record","integrity":"/paper/2507.10174/integrity","json":"/paper/2507.10174/citation-record.json","paper":"/paper/2507.10174"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.733119Z","title":"Bhargava, S","venue":null,"work_id":"be8f115c-98a7-473f-b3e2-0715370969cf","year":2024},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.149015Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:8ab5ec15de64a3bb041858f1511fe6469e8e9c6160dd3ce422e11a6f18475a59","observation_id":"dbc15585-d58c-4e5a-a0e4-f9a187977dd9","resolution":{"observed_at":"2026-08-06T17:42:29.738241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.717122Z","title":"Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions","venue":null,"work_id":"2ffe9b89-d153-4ec7-aaa7-112e6eb4ffba","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.206025Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:0103044a8a996c4211e462b8d3c6828d9f702788677d8d4cf1e2c27d447bf6aa","observation_id":"31d93aa1-c042-4bcc-8421-f0c211f82ad6","resolution":{"observed_at":"2026-08-06T17:42:29.722222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.700174Z","title":null,"venue":null,"work_id":"6f8d7c81-c761-4fa6-9c2d-ef5a40b3fbb4","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.279527Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:135d08a4d42dcb0fa59a8685e9738766763c163475eeab315aeca638b42020a5","observation_id":"5a73efac-3a6a-47e5-a043-c0262fefa2c5","resolution":{"observed_at":"2026-08-06T17:42:29.704959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.684010Z","title":"RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021","venue":null,"work_id":"22f7db1d-520a-4e20-b7fe-d43aaf3d8a7c","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.375372Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:734fa1fc5dd5045089e5163e311284d6a8e5c52822490323284abaf4507bb496","observation_id":"7f58d721-7ad8-4922-9109-4ea5702c998a","resolution":{"observed_at":"2026-08-06T17:42:29.689576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-06T17:42:25.451565Z","title":"D4rl: Datasets for deep data-driven reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.451565Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:0848610372d18a895d7e549f85f981e8e3956e8c4c08c5e5d871108c9ea4c850","observation_id":"ec031408-03dc-4c7c-a2b4-e955710b52ad","resolution":{"observed_at":"2026-08-06T17:42:25.451565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.668322Z","title":"Generalized decision transformer for offline hindsight information matching","venue":null,"work_id":"bd110180-089f-489c-8629-c61b4cb10c83","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.535696Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:be01caeab9b8e93ee465aecd74b1c360cb4d4b0936c322b26c64c6b74cd6ef62","observation_id":"e47883e8-a3c2-4d0b-aa3d-0caeeb910645","resolution":{"observed_at":"2026-08-06T17:42:29.673067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.653262Z","title":"Instruction-driven history-aware policies for robotic manipulations","venue":null,"work_id":"e82dc81a-7e11-4164-855d-569d124d41c7","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.640038Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:3cbfa7cc041a8deb959dee95e0535aaa21d8b0c0838ff068900e71a9c50f81bb","observation_id":"4ef54741-ec1f-42e3-a52a-34a18a81a9a1","resolution":{"observed_at":"2026-08-06T17:42:29.657960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03747","last_updated":"2023-03-07T09:10:34Z","snapshot_observed_at":"2026-08-08T20:14:17.721475Z","submitted_at":"2023-03-07T09:10:34Z","title":"Graph Decision Transformer","version":1},"cited_work":{"arxiv_id":"2303.03747","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.03747","snapshot_observed_at":"2026-08-06T17:42:27.669175Z","title":"Graph Decision Transformer","venue":"cs.LG","work_id":"7bf70bf2-784d-4ee8-be0d-9b8c2349e7bc","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.721552Z"},"links":{"cited_paper":"/paper/2303.03747","citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:3098440305cf4b78cc4da44a06219593043f34c48df843ed13daa60bce3803ff","observation_id":"0bc8c67b-1b22-479d-b29e-4d3b65f580fb","resolution":{"observed_at":"2026-08-06T17:42:27.767178Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.637906Z","title":"Q-value regularized transformer for offline reinforcement learning","venue":null,"work_id":"7ac53737-a0b1-4ae8-81b6-d6a4e153b1b0","year":2024},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.780542Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:9dcf0cb760e4f43bb096c05415a834bb01681d122f4943b7d44cb04373623610","observation_id":"efcfa5f3-79e9-4e65-930e-b873ba4f623c","resolution":{"observed_at":"2026-08-06T17:42:29.642825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.622836Z","title":"Janner, Q","venue":null,"work_id":"354addf4-6d0d-4d63-a278-b65bb58f1299","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.875737Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:6c51540c0481290d8fc97637399666522ab697e46aa42aaf03c0e33bcf6c0c56","observation_id":"088c834f-0f9f-4a8a-9fe5-0c725dd7329a","resolution":{"observed_at":"2026-08-06T17:42:29.627010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.603183Z","title":"Kumar, A","venue":null,"work_id":"87b49d90-bc1d-46c7-b4a7-19b708c5c8ac","year":2020},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:25.943789Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:7924cce6eb87f25f67d47581dfc3a1a0d38eb930b01f6355639f5b6a324548b9","observation_id":"08ae6021-c678-4d94-8280-2d51ca1d817b","resolution":{"observed_at":"2026-08-06T17:42:29.608950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.587527Z","title":"Pre-trained language models for interactive decision-making","venue":null,"work_id":"6741bd2a-f7e1-46cb-93ea-662f0a8866a8","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.015215Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:10077edc556c73ac3fccd9a2e4bea543afa55d734064a34a12a1f5ef52849534","observation_id":"171cd69c-06aa-4efc-93cf-176c9a118167","resolution":{"observed_at":"2026-08-06T17:42:29.593244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.571891Z","title":"A survey on transformers in reinforcement learning","venue":null,"work_id":"5ec496a3-d4e9-4ad0-bc97-d9fd55e80306","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.094983Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:1ec16350c86d8a1a00c08fda948510434890979493fcc1ba1265cc9cba50ee1b","observation_id":"cf874310-516d-41b6-ada4-ea9f5308f1d0","resolution":{"observed_at":"2026-08-06T17:42:29.576712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.556989Z","title":"What matters in learning from offline human demonstrations for robot manipulation","venue":null,"work_id":"9bbb1f94-b44c-449e-ba2d-399f550d6194","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.161012Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:0366f875f64a4551b5c3e9d9d979b537be3f2694b9c8c0ec20885dd7ed40a708","observation_id":"641db10f-ae80-450f-bdac-359902819666","resolution":{"observed_at":"2026-08-06T17:42:29.562118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.539593Z","title":"Stabilizing transformers for reinforcement learning","venue":null,"work_id":"a8d98a3b-62c8-452f-9047-5b88f5ae1507","year":2020},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.256502Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:529898353e7ec9ca8d15b3bf844cf027cd8907eea47586ba770722acd87c9df4","observation_id":"bb5e84e9-87bb-4d0a-affc-d263cece530e","resolution":{"observed_at":"2026-08-06T17:42:29.544626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.523288Z","title":"You can’t count on luck: Why decision transformers and rvs fail in stochastic environments","venue":null,"work_id":"1990bf7c-480c-423c-837e-cd579ddc32ae","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.329261Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:043afcd4845a78723a45f15f963f5b9cf7992ebc0dba30f16ebcbe28a1d7090a","observation_id":"7a6e986d-fc7b-4212-aa8d-04fd4e946465","resolution":{"observed_at":"2026-08-06T17:42:29.528256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.507865Z","title":null,"venue":null,"work_id":"f8318558-7abc-479e-b37b-37dcb2ae2ae0","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.435256Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:29ae1c289035ea8370189db8dfd4a3eb400a03a1bd8aa1cc3815d39dcc07914c","observation_id":"9fb593fa-9457-4019-8ac4-f50b52d6e8d8","resolution":{"observed_at":"2026-08-06T17:42:29.512678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.491256Z","title":"The sensory neuron as a transformer: Permutation-invariant neural networks for reinforcement learning","venue":null,"work_id":"0f8fc976-4283-4482-997b-8f31cebc118f","year":2021},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.447168Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:901c87f943870fb934f09c8ec796dddbdd1339e556b525e44ab44db9b5f5dbcd","observation_id":"0dd13ca9-b91c-4e5c-8f73-15c92ba8be4e","resolution":{"observed_at":"2026-08-06T17:42:29.496764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.473902Z","title":"CORL : Research-oriented deep offline reinforcement learning library","venue":null,"work_id":"3f953e31-f17d-4f52-a9da-a9b40f58c55c","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.512755Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:ced9e7990349b6704489bdcd15dcac6b2427cc9d3532df4a6f630a14e00267e6","observation_id":"58da4b59-b99f-40b8-abcd-56462b70d50c","resolution":{"observed_at":"2026-08-06T17:42:29.478645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:29.184580Z","title":"Vaswani, N","venue":null,"work_id":"15e8c3c7-fa8a-4dc0-96fe-4cd586a7ab83","year":2017},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.676689Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:f7acd70c01a9e1f69fff9f4d5147c62ddbe4df6a8e3f289c166e7afdfc93c87a","observation_id":"9380dfbe-915e-420e-8ac7-98ea048683a5","resolution":{"observed_at":"2026-08-06T17:42:29.340003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:28.771330Z","title":"Bootstrapped transformer for offline reinforcement learning","venue":null,"work_id":"c2090f59-4ce6-4693-8c49-09af212e97ba","year":2022},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.793463Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:0d2d9d138a2b122d91efb6d01ffbd21ca3e475474225c9659373a310b7b5925e","observation_id":"aede287f-7bda-48c5-94b4-2f4aeceb1295","resolution":{"observed_at":"2026-08-06T17:42:28.931143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:28.351704Z","title":"Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl","venue":null,"work_id":"3b954924-9575-4e26-b9ec-bbff0232d8f4","year":2023},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:26.945947Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:b6a06ae6de37fbbe69feb157b9f01457af9661dafe23ee6f3862f100c74f6e11","observation_id":"75a474c1-d5e6-45f3-90de-f9c1df2c31fe","resolution":{"observed_at":"2026-08-06T17:42:28.594866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-06T17:42:27.045068Z","title":"Robosuite: A modular simulation framework and benchmark for robot learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:27.045068Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:0dba8b1335f9eb7907837abe656299f364ed7300e3636e3ddad0da9b6954b0f3","observation_id":"d4cd0e3f-4e41-4c86-b79d-a1e053e281c4","resolution":{"observed_at":"2026-08-06T17:42:27.045068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:27.979136Z","title":"Robosuite environments documentation","venue":null,"work_id":"46cd90ad-3df2-456d-ba59-c68058ad9ae9","year":2020},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:27.201794Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:d1daf9669d4d0f0ec48d56a33edea58f992c92e5c81e513011ce91605c129f85","observation_id":"d4345cf4-a529-412b-8170-5051cfd2d355","resolution":{"observed_at":"2026-08-06T17:42:28.171415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:27.411920Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:42:27.411920Z"},"links":{"citing_paper":"/paper/2507.10174"},"observation_digest":"sha256:5f827a1cbbd9bb22cdf7fdf9c79051cd0c6eddc1bf7976c76d6c8c5182158699","observation_id":"7e72b31b-b612-4508-9cd0-b8cc4a2c8700","resolution":{"observed_at":"2026-08-06T17:42:27.411920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.10174","last_updated":"2025-07-14T11:36:31Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T08:36:00.948442Z","submitted_at":"2025-07-14T11:36:31Z","title":"Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":19},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2507.10174."}