{"as_of":"2026-08-06T15:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10a26d3dbfbd3c5979cc7b0400cfbe2bad111e9ed96b762191898e9aadd0c07b","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T10:48:28.980868Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T19:16:57.396710Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T03:46:32.446959Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2506.05762","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.05762","snapshot_observed_at":"2026-07-02T03:46:32.446959Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","venue":"cs.LG","work_id":"e73e509b-76d7-43f3-b9f2-6e64b9e098fd","year":2025},"citing_paper":{"arxiv_id":"2606.04172","last_updated":"2026-06-02T19:36:13Z","snapshot_observed_at":"2026-07-06T23:44:19.059079Z","submitted_at":"2026-06-02T19:36:13Z","title":"Affordance2Action: Task-Conditioned Scene-level Affordance Grounding for Real-Time Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T09:44:51.896204Z"},"links":{"cited_paper":"/paper/2506.05762","citing_paper":"/paper/2606.04172"},"observation_digest":"sha256:168a8f04416ae307dd3fc2b4f5aa2bcca699b6114a499b76517e0d907025a982","observation_id":"e268bf49-d77e-45b9-8364-a9960343936c","resolution":{"observed_at":"2026-07-02T03:46:32.448376Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05762","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Bitrajdiff: Bidirectional trajectory generation with diffusion models for offline reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-02T16:12:54.212857Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2506.05762","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:629269d593eec7ca1217e5a58be328731c60c565c48d7fd8f69ecfce204d752a","observation_id":"35c39e8f-1aa7-45f6-924f-c07065ea3ef2","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05762/citation-record","integrity":"/paper/2506.05762/integrity","json":"/paper/2506.05762/citation-record.json","paper":"/paper/2506.05762"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.15657","last_updated":"2023-07-10T07:25:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-28T18:59:02Z","title":"Is Conditional Generative Modeling all you need for Decision-Making?","version":4},"cited_work":{"arxiv_id":"2211.15657","doi":"10.48550/arxiv.2211.15657","metadata_source":"pith","pith_arxiv_id":"2211.15657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is Conditional Generative Modeling all you need for Decision-Making?","venue":"cs.LG","work_id":"dac365c0-e557-4886-9a1b-179151a66160","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2211.15657","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:600516a0ce28a32aa8b30350bdb062a758470244f1dd9b89dc1de97dcb92de37","observation_id":"c7b2bebc-ddaa-4b1b-b6a5-71ad604de36f","resolution":{"observed_at":"2026-05-19T10:52:15.310681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:28.005241+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:28.005241+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chemingui, A","venue":null,"work_id":"a9298a12-9f14-4e80-ad02-39a2afcd0737","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:5e5bfbd6a0538b9fba65e3444fb1a6bae5415b364bb7661fbc8dce39580248c9","observation_id":"fb6a594c-3ff8-4524-abb7-7961a2e15350","resolution":{"observed_at":"2026-05-19T10:57:18.836842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02771","last_updated":"2024-11-29T10:23:56Z","snapshot_observed_at":"2026-07-06T17:11:58.725249Z","submitted_at":"2024-01-05T12:01:19Z","title":"Powerformer: A Section-adaptive Transformer for Power Flow Adjustment","version":5},"cited_work":{"arxiv_id":"2401.02771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.02771","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8cd8f6a5-643f-4f9d-b9cf-79657e1d2751","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2401.02771","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:fadfdc04ecdbef17b8189644635184b70c891a142f96ddb2158e9dd92f2f79fc","observation_id":"6853cd3b-dbe2-4a4a-b7a5-59433c27341d","resolution":{"observed_at":"2026-05-19T10:52:15.316376Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4f558309-f9c4-4663-99a2-7749e2be0c35","year":2021},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:99b4df623576953f871668a256ad95d2061e1d463841fdaef2efc5bbe42845f5","observation_id":"85dcc496-096f-4739-9b92-aeccffcc7e49","resolution":{"observed_at":"2026-05-19T10:57:18.834466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b879e283-7dbc-43bd-aea9-3758a69d1e3a","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:e85776aeb3a19ec66c8d842606ecbcdd5f9f07c126712ce3406ca63d407fd546","observation_id":"27b7d585-a06a-49c9-8565-b6af1f27c458","resolution":{"observed_at":"2026-05-19T10:57:18.829111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03570","last_updated":"2024-10-15T20:56:47Z","snapshot_observed_at":"2026-08-02T12:07:35.477265Z","submitted_at":"2024-02-05T22:43:57Z","title":"Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2402.03570","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03570","snapshot_observed_at":"2026-07-03T18:38:49.868506Z","title":"arXiv preprint arXiv:2402.03570 , year=","venue":null,"work_id":"539002ec-5bee-4bd4-ba32-9d068c677cbd","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2402.03570","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:5dabcab08c15d7eaea9bf851df556e5f1aef1c1ed07fdc9fb69f051ab92f4d41","observation_id":"5d634853-c61a-4609-811e-75cbe86336d3","resolution":{"observed_at":"2026-05-19T10:52:15.288028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09509","last_updated":"2024-10-27T02:56:03Z","snapshot_observed_at":"2026-07-06T18:30:37.311343Z","submitted_at":"2024-06-13T18:00:24Z","title":"CleanDiffuser: An Easy-to-use Modularized Library for Diffusion Models in Decision Making","version":2},"cited_work":{"arxiv_id":"2406.09509","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09509","snapshot_observed_at":"2026-06-30T10:04:36.138119Z","title":"Cleandif- fuser: An easy-to-use modularized library for diffusion models in decision making","venue":null,"work_id":"110ffcfc-7e55-44cb-8546-932e62c09b9e","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2406.09509","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:4fcdd332b6ed940fac01b346162a0241c3582c7d8d6876312eadfeba4e2706ea","observation_id":"926d6637-e78a-4624-990b-80f8cd33e994","resolution":{"observed_at":"2026-05-19T10:52:15.307723Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.06416","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:28:55.612642Z","title":"Fathi, T","venue":null,"work_id":"24dc9044-6eb8-4e80-8c16-1798bdc436ac","year":2025},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:528ff31beeb6ab6df8b307c15cc3bd78222edd32d7f5439770dfb9c96c781267","observation_id":"5213234e-77d8-47d8-921d-5d0927790d75","resolution":{"observed_at":"2026-05-19T10:52:15.313386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2004.07219","doi":"10.48550/arxiv.2004.07219","metadata_source":"pith","pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","venue":"cs.LG","work_id":"47082e4e-a4a5-418b-bf4f-4667355065fc","year":2020},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:635f61cccb6342540f60a9007b42313da4e0253ed8669848a10b3224689f2572","observation_id":"08e7d6ac-5f1e-46a2-a11f-46da1e673db4","resolution":{"observed_at":"2026-05-19T10:52:15.282652Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fujimoto and S","venue":null,"work_id":"4533d201-52d8-4a7c-9f20-4616221407e6","year":2021},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:1c168b0a7f74a09dd23610faae9f603694866ae94fac07851c080d6d8d6a60f3","observation_id":"3a678d67-a3f2-4d90-80f9-02b4c2272a4d","resolution":{"observed_at":"2026-05-19T10:57:18.825348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fujimoto, D","venue":null,"work_id":"20b8135f-064f-4501-9333-61213afbb21f","year":2019},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:b26934d19149eb1b08a7a861411c5dee1fbfce66191438b5e6aed2bd8ef1c38c","observation_id":"19864077-c047-4c32-aab9-2a7cfacae91c","resolution":{"observed_at":"2026-05-19T10:57:18.822755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.08933","last_updated":"2023-02-14T06:45:49Z","snapshot_observed_at":"2026-07-06T14:06:34.310083Z","submitted_at":"2022-10-17T10:49:08Z","title":"DiffuSeq: Sequence to Sequence Text Generation with Diffusion Models","version":3},"cited_work":{"arxiv_id":"2210.08933","doi":"10.48550/arxiv.2210.08933","metadata_source":"pith","pith_arxiv_id":"2210.08933","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DiffuSeq: Sequence to Sequence Text Generation with Diffusion Models","venue":"cs.CL","work_id":"180ac1b2-1f1e-4b77-9bf9-7a16f0167e1b","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2210.08933","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:bafc34a7feef20525fab4ee03819b95ddb02291d6aeefebcb4c35a54031805cd","observation_id":"f24350cc-dca8-444c-bb04-5000583814d6","resolution":{"observed_at":"2026-05-20T06:50:38.345995Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":"2010.02193","doi":"10.48550/arxiv.2010.02193","metadata_source":"pith","pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Atari with Discrete World Models","venue":"cs.LG","work_id":"154f6f5f-bb34-456d-8107-45d5b51433ce","year":2020},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:a0fb66e6cce8271abcc173a50b6e55798b894c79ee971e802f5eb678bc7a401a","observation_id":"434735f2-a667-411c-9900-105bf2cd3b24","resolution":{"observed_at":"2026-05-19T10:52:15.264522Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":"2301.04104","doi":"10.1126/sciadv.adu2488","metadata_source":"pith","pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Diverse Domains through World Models","venue":"cs.AI","work_id":"6aeb260f-8c7c-4f9c-b98b-067cd7c59acd","year":2023},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:9382261a2e4ea93e4e62f7ea7494d7afa217e18228daa27382e6e8d35bb33644","observation_id":"c329f2cb-2944-4c74-afbf-2f548ebeb6a6","resolution":{"observed_at":"2026-05-19T10:52:15.259118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04955","last_updated":"2022-07-19T18:14:36Z","snapshot_observed_at":"2026-07-06T12:46:08.838773Z","submitted_at":"2022-03-09T18:58:28Z","title":"Temporal Difference Learning for Model Predictive Control","version":2},"cited_work":{"arxiv_id":"2203.04955","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.04955","snapshot_observed_at":"2026-07-04T19:00:06.256105Z","title":"Temporal difference learning for model predictive control","venue":null,"work_id":"7bad3438-3b8c-438f-98c5-122e3c23095a","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2203.04955","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:e6342c899cdba3a976891cb3a9024fbc5d51ad5c95b57f2cd4bea08f3102fae6","observation_id":"a750b801-2ecd-4803-8de8-21424d59e889","resolution":{"observed_at":"2026-05-19T10:52:15.261991Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16828","last_updated":"2024-03-21T17:56:19Z","snapshot_observed_at":"2026-07-31T05:32:29.431480Z","submitted_at":"2023-10-25T17:57:07Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","version":2},"cited_work":{"arxiv_id":"2310.16828","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.16828","snapshot_observed_at":"2026-07-08T02:04:26.234596Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","venue":"cs.LG","work_id":"360ec5fb-79fd-4490-bc73-3d161609c42d","year":2023},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2310.16828","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:52ab9e65b6424dd0380d70fccc09c59afd4e3ac7569384e0ea73fae21f3934f7","observation_id":"0e07a3f6-e190-40e7-9a4d-bd97715347a2","resolution":{"observed_at":"2026-05-19T10:52:15.277609Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0b4dc28d-962e-4f8f-b85d-fad308fe0b72","year":2023},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:e20cbc5f86e30980072ef68970ea5ce13d9272ffd3d21c3f58a8c8acc35dc54d","observation_id":"26deeae8-49f9-4235-afd4-111a885c3fb2","resolution":{"observed_at":"2026-05-19T10:57:18.820440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":"2207.12598","doi":"10.1109/cvpr52733.2024.02494","metadata_source":"pith","pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Classifier-Free Diffusion Guidance","venue":"cs.LG","work_id":"acf2c588-c088-4a6c-938e-150ad7c666d7","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:42b10be4754542c069142855db57a25c469136cc9c646d3b40b6ea37b4d5ef19","observation_id":"692fca37-7c1d-49a8-9433-765d3fc4946e","resolution":{"observed_at":"2026-05-19T10:52:15.269779Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"66c9621f-58ed-4bde-a82f-9a09768a6396","year":2020},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:6e24cffc6884bf5213f5839396e2a4be924d38b3d6a978a1f55b459a9f816cce","observation_id":"5f22db4e-835a-4f59-a1c7-fb0fdcac2594","resolution":{"observed_at":"2026-05-19T10:57:18.816076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06356","last_updated":"2024-04-09T14:46:48Z","snapshot_observed_at":"2026-08-04T07:21:52.509781Z","submitted_at":"2024-04-09T14:46:48Z","title":"Policy-Guided Diffusion","version":1},"cited_work":{"arxiv_id":"2404.06356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.06356","snapshot_observed_at":"2026-07-02T11:46:56.124252Z","title":"Janner, M., Li, Q., and Levine, S","venue":null,"work_id":"f39e3076-ea89-4c9a-991b-6e4d83a0231e","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2404.06356","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:2a0b14aa4425dc8f5fed682137e5221ecfe998e99dbfb894246ce5ff2b4de833","observation_id":"8ad364aa-fb9a-490d-a63b-7b4109fa9b76","resolution":{"observed_at":"2026-05-19T10:52:15.299387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09991","last_updated":"2022-12-21T01:06:18Z","snapshot_observed_at":"2026-08-06T05:32:02.292779Z","submitted_at":"2022-05-20T07:02:03Z","title":"Planning with Diffusion for Flexible Behavior Synthesis","version":2},"cited_work":{"arxiv_id":"2205.09991","doi":"10.48550/arxiv.2205.09991","metadata_source":"pith","pith_arxiv_id":"2205.09991","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Planning with Diffusion for Flexible Behavior Synthesis","venue":"cs.LG","work_id":"38b2c635-b754-412a-a8f5-dfcf3e405c95","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2205.09991","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:237a0e1f76b873f87c1083196c17a88d6b66381d7260683ebbdb5f74fd50a2b0","observation_id":"1f6791ec-640f-4211-a05b-0e586eccd988","resolution":{"observed_at":"2026-05-19T10:52:15.252085Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kidambi, A","venue":null,"work_id":"614c7e9a-26a8-471f-ae40-2d49ff05acb4","year":2020},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:7a172236afe69c42417dd98cb319a088bc969d37eb8051f1f6973f7f2aaa7998","observation_id":"18a6e763-0b7c-4e2f-83b1-ea1e27b0614c","resolution":{"observed_at":"2026-05-19T10:57:18.813044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":"2110.06169","doi":"10.48550/arxiv.2110.06169","metadata_source":"pith","pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","venue":"cs.LG","work_id":"4adca4ff-8975-49b3-aee4-2ef7e0f95275","year":2021},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:28240e4f2dddee0b7be94718b978b6e4cd344beee1711559754ce882002b4aa8","observation_id":"b365b5b2-f975-46b6-93a0-8ab5b8215e8d","resolution":{"observed_at":"2026-05-19T10:52:15.249480Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kumar, A","venue":null,"work_id":"fb32b3df-d5b4-4ef0-af2d-97738daae1c5","year":2020},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:9b426c4ea6e6c4021fada6116e8aa62c90aaafc7380234084ad80c54073f4483","observation_id":"852b77a3-10b6-4120-9785-3e2f361accea","resolution":{"observed_at":"2026-05-19T10:57:18.810092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":"2005.01643","doi":"10.1613/jair.1.17526","metadata_source":"pith","pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","venue":"cs.LG","work_id":"597b6f46-d60f-451f-8f34-7d32876a9014","year":2020},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:392f3008cc66ef4b32b062106621d4231a5eb0e33afc602a21197894ae9ba09e","observation_id":"b21890e2-3a96-40fe-b354-5b868aa601e0","resolution":{"observed_at":"2026-05-19T10:52:15.246580Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02439","last_updated":"2024-02-22T00:05:12Z","snapshot_observed_at":"2026-07-06T17:25:01.583656Z","submitted_at":"2024-02-04T10:30:23Z","title":"DiffStitch: Boosting Offline Reinforcement Learning with Diffusion-based Trajectory Stitching","version":2},"cited_work":{"arxiv_id":"2402.02439","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02439","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffstitch: Boosting offline reinforcement learning with diffusion-based trajectory stitching","venue":null,"work_id":"3db8f1ac-3bfd-4d01-b111-e04bdbce0a89","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2402.02439","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:3c46e947dd117fc64245385f393489928eeedbabf12b0d96505813f81a8b62ff","observation_id":"0e7c37aa-249c-4739-bd17-aa0709625456","resolution":{"observed_at":"2026-05-19T10:52:15.272603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00807","last_updated":"2024-10-02T23:24:50Z","snapshot_observed_at":"2026-08-05T14:56:30.366947Z","submitted_at":"2024-02-01T17:44:11Z","title":"Augmenting Offline Reinforcement Learning with State-only Interactions","version":2},"cited_work":{"arxiv_id":"2402.00807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.00807","snapshot_observed_at":"2026-07-04T06:49:37.747849Z","title":"Li and X","venue":null,"work_id":"71f0f37d-79fa-4b57-b05b-f907bfee0cba","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2402.00807","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:0afc5af604190b135c931b52c841de6bb8c9e01283c65c752d9a86b05acd245a","observation_id":"3a9d179e-0128-48c1-88fa-c885d2afcbba","resolution":{"observed_at":"2026-05-19T10:52:15.243583Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b99d287c-da7a-4cb3-983f-7a788ca9b864","year":2008},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:8049b12b9a8c0013afd9ab71baf6083652a5cf3e6e03a1182f8847ed226a1e34","observation_id":"605d93f3-9d19-41f5-8908-036612ec4efc","resolution":{"observed_at":"2026-05-19T10:57:18.806240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08232","last_updated":"2023-06-14T04:06:41Z","snapshot_observed_at":"2026-07-06T15:42:22.027803Z","submitted_at":"2023-06-14T04:06:41Z","title":"Curricular Subgoals for Inverse Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2306.08232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.08232","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"39ffbd8f-b466-42f1-babe-314ec1b4a5e2","year":2023},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2306.08232","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:297fcb268a7dbd7015b54c38d8fe48f1393a5377e5ef0a70a607251ea59abf87","observation_id":"4f0c6d2c-fc85-49be-ba72-d44c49184abe","resolution":{"observed_at":"2026-05-19T10:52:15.256479Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eebda829-946e-47d4-a84b-ce5608bac25e","year":2023},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:9f22245be2c51b55c2805e2627436e7a36148063c0ec571826f16e8626d6b1ab","observation_id":"e40373d9-1630-4c22-8a51-04c0fe1ff336","resolution":{"observed_at":"2026-05-19T10:57:18.803277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"675b0a6e-be6e-49ee-9c7f-e32ef0b2982e","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:3e98f4470d496de0ce43c6842aba89ab5f49334569692780d97d383e188be0ed","observation_id":"a79bacb1-09cc-4890-8b4b-07bcebf07c77","resolution":{"observed_at":"2026-05-19T10:57:18.800718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":"2006.09359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-07-08T22:35:40.693821Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","venue":"cs.LG","work_id":"f0a11265-1acf-4ffc-a822-08bd04b6bddf","year":2020},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:06e921061edff08235b5e6e8eaf92af434bc00d8d6c9658c89e5b0c5d62b03a7","observation_id":"b1f2c794-687e-4de9-bf71-67158422473c","resolution":{"observed_at":"2026-05-19T10:52:15.240025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09329","last_updated":"2024-10-28T23:33:19Z","snapshot_observed_at":"2026-08-02T19:31:23.537664Z","submitted_at":"2024-06-13T17:07:49Z","title":"Is Value Learning Really the Main Bottleneck in Offline RL?","version":2},"cited_work":{"arxiv_id":"2406.09329","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09329","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is Value Learning Really the Main Bottleneck in Offline RL?, October 2024","venue":null,"work_id":"b30f8cbc-35db-4657-bc36-55f1e3b02c9f","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2406.09329","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:b27c06d62e783b730c48b5cebd6650a2d67d1afa221677a90590300433e87936","observation_id":"70bb6af2-175d-4079-90f9-62e81ef5c241","resolution":{"observed_at":"2026-05-19T10:52:15.304858Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Paster, S","venue":null,"work_id":"3d6344a8-1f65-4934-ab44-41925c465a63","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:994ec2275390855ca7529607ea738a414f2f4fff3ddaf8407e5a567dd8a3995c","observation_id":"c41f7c9a-f5f6-4907-b315-16b239868602","resolution":{"observed_at":"2026-05-19T10:57:18.797178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bcc8957b-ac67-44d7-969f-9aa95fa03c02","year":2014},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:7dfc29e6d67a744d9cda07bb24a42cc8eb4a48059d66461ef21a5faaf48377d4","observation_id":"e32e77f2-ece5-4ac3-bb5f-e9a7d67f8ddc","resolution":{"observed_at":"2026-05-19T10:57:18.793796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"33253052-22f1-469d-b533-f8b044f3a258","year":2023},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:4ed4005bbaae0efeaf473158e164646019af4cb24961e7b1505d72f6bb331305","observation_id":"11455ce9-722a-4ea8-a5cf-32406d749ba0","resolution":{"observed_at":"2026-05-19T10:57:18.790651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.06665","last_updated":"2025-08-29T04:07:26Z","snapshot_observed_at":"2026-07-06T14:17:30.922581Z","submitted_at":"2022-11-12T13:52:06Z","title":"A Survey on Explainable Reinforcement Learning: Concepts, Algorithms, Challenges","version":6},"cited_work":{"arxiv_id":"2211.06665","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.06665","snapshot_observed_at":"2026-07-04T17:40:00.099254Z","title":"A survey on explainable rein- forcement learning: Concepts, algorithms, challenges,","venue":null,"work_id":"200d1512-75e1-43d6-8eea-6f19caf74ae7","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2211.06665","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:b0073c45844f1f898057b5c3e2e9ef600502f95d089ac03337d2843c9ca525be","observation_id":"77d558e4-f372-4de8-aa16-78e042ab31f7","resolution":{"observed_at":"2026-05-19T10:52:15.302058Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"55f3b0e1-bee3-4fc9-84ce-ff1d8eb44005","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:1d8bf2008c4ea227e8251140dff94599b704161ee396e29b9f4c3d1fe871cc2d","observation_id":"23ff9637-a804-4d3d-9f6d-97d16d913d1a","resolution":{"observed_at":"2026-05-19T10:57:18.787172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07071","last_updated":"2025-08-13T15:48:10Z","snapshot_observed_at":"2026-08-04T14:44:33.124746Z","submitted_at":"2024-10-09T17:15:30Z","title":"Retrieval-Augmented Decision Transformer: External Memory for In-context RL","version":3},"cited_work":{"arxiv_id":"2410.07071","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07071","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schmied, F","venue":null,"work_id":"cab2840c-e1b7-4f83-aefb-4d61725601de","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2410.07071","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:d95bd9e63550d2fec314ac60c7c0ca005992c2ff4a2848285a0ad4996cf7de47","observation_id":"928d07ef-5917-4808-873b-c29bb6259c24","resolution":{"observed_at":"2026-05-19T10:52:15.296534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5df263a5-be32-467c-87cc-9ad035c6979f","year":2015},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:10a7295d8dffe2332f0bd6941e534a60005bc8211cef32095fe4aee7335e40ab","observation_id":"d6dfad1a-88e8-4a0d-a4ad-88e729d4c1ec","resolution":{"observed_at":"2026-05-19T10:57:18.783640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8e531222-2776-4507-9850-1762d2a075de","year":2021},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:ae11e2963f928c456a7b3abd17bd4fc155fcaf6eff87a6cc130f1dd40c8f8852","observation_id":"35dffa2f-c7e8-4f15-84bd-0816f5b5f29b","resolution":{"observed_at":"2026-05-19T10:57:18.780536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"be4669b1-08f2-437c-a649-6d34e1b8112a","year":2018},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:2e3d338ff4f7ddc1609e24e8daee4844b555b86433b155e6937d4d1c0fb82ebb","observation_id":"73cb5e41-73b1-4880-b855-fa88ec14db27","resolution":{"observed_at":"2026-05-19T10:57:18.777409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18082","last_updated":"2025-05-08T23:56:41Z","snapshot_observed_at":"2026-07-06T19:38:35.617923Z","submitted_at":"2024-10-23T17:59:52Z","title":"Prioritized Generative Replay","version":2},"cited_work":{"arxiv_id":"2410.18082","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18082","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9915b139-e091-4305-91b3-d1660f21c2cd","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2410.18082","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:51ab6bf9f2b3e52b7eddc49d2b81e03ed75445e29e50abb1f511e076004e01d1","observation_id":"b7f1c97b-30ed-4ad2-a29c-26781fdfb1e4","resolution":{"observed_at":"2026-05-19T10:52:15.293768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.06193","last_updated":"2023-08-25T19:39:32Z","snapshot_observed_at":"2026-07-06T13:41:14.687081Z","submitted_at":"2022-08-12T09:54:11Z","title":"Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2208.06193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.06193","snapshot_observed_at":"2026-07-04T06:49:37.744619Z","title":"Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning","venue":"cs.LG","work_id":"dd3fee6a-963f-4e7d-8dd8-b30bd0b76fb5","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2208.06193","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:95f7a34a8eed85d5871108021e17657ce82965aad49598eb5ec41cf1a9c8a455","observation_id":"77a45f2d-adb8-4921-b993-68bdfb79c047","resolution":{"observed_at":"2026-05-19T10:52:15.290962Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"135614da-a36e-43e0-8f2d-7c96e3d86905","year":2024},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:0db3645ea8e60112ac2ef900fa7cffc4f49f6022eae8635791fcbaa6fec9f5ef","observation_id":"37a3a6e3-01c3-4e8e-848c-d21024b783e5","resolution":{"observed_at":"2026-05-19T10:57:18.772358Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15810","last_updated":"2023-03-28T08:30:01Z","snapshot_observed_at":"2026-07-06T15:08:49.727355Z","submitted_at":"2023-03-28T08:30:01Z","title":"Offline RL with No OOD Actions: In-Sample Learning via Implicit Value Regularization","version":1},"cited_work":{"arxiv_id":"2303.15810","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.15810","snapshot_observed_at":"2026-07-03T04:17:36.940883Z","title":"-A\"), 1e6 (","venue":null,"work_id":"d99b71bd-b62c-4f1a-95a3-bd753cb9c7f1","year":2023},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2303.15810","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:e72fd3d3e58d9b1e50babf27ca0175e1ff90d90212a79c3047233f317f2bacfc","observation_id":"0c67fefc-1819-42ba-9415-5af47f1e6ea1","resolution":{"observed_at":"2026-05-19T10:52:15.285443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yang and Y .-X","venue":null,"work_id":"11bb41be-910f-450c-8f41-e407b885f8c7","year":2025},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:6dc26c430d54a9eb229f1919452626ad75c918e86a1465a7a2c4711607a84e23","observation_id":"8348829a-9896-4678-b0cd-9eb6a90d4460","resolution":{"observed_at":"2026-05-19T10:57:18.767883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cea5d8ab-e09e-4ddb-8f90-290c339e8a80","year":2020},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:e3ababb9bbbb209bdb6ebada15b43948fb6dcd0fa0b5485fb0bf98f45036a81f","observation_id":"d30685d9-dd1c-47ab-9992-edcefaffc000","resolution":{"observed_at":"2026-05-19T10:57:18.765507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1b39f983-b25b-4998-96d2-9e04dcb7ab90","year":2021},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:489b9a6a47da9e4e812ab873684a00695f7375e04c8541a5b9c3334588907d59","observation_id":"73114c53-c202-4234-a5bb-c65de2f59ac4","resolution":{"observed_at":"2026-05-19T10:57:18.762449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09241","last_updated":"2022-10-17T16:34:01Z","snapshot_observed_at":"2026-07-06T14:06:48.707061Z","submitted_at":"2022-10-17T16:34:01Z","title":"Boosting Offline Reinforcement Learning via Data Rebalancing","version":1},"cited_work":{"arxiv_id":"2210.09241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.09241","snapshot_observed_at":"2026-07-01T14:25:45.854529Z","title":"Boosting offline reinforcement learning via data rebalancing.arXiv preprint arXiv:2210.09241,","venue":null,"work_id":"597c2975-3cab-4243-ac80-848b97856835","year":2022},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2210.09241","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:89b33655c2266537c55e95e0d7fc86ba4f9cd92936ed91d59182a8efce55b8e0","observation_id":"fbf7fc05-7fff-4ef7-a5cd-6f2bbb3f7db7","resolution":{"observed_at":"2026-05-19T10:52:15.280066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04660","last_updated":"2023-07-26T10:06:06Z","snapshot_observed_at":"2026-08-03T11:18:58.487027Z","submitted_at":"2023-04-10T15:36:54Z","title":"Uncertainty-driven Trajectory Truncation for Data Augmentation in Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2304.04660","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.04660","snapshot_observed_at":"2026-07-04T08:49:42.764961Z","title":"Zhang, J","venue":null,"work_id":"a5888533-174c-4cd9-baa6-130edaf4012d","year":2023},"citing_paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-19T10:48:28.980868Z"},"links":{"cited_paper":"/paper/2304.04660","citing_paper":"/paper/2506.05762"},"observation_digest":"sha256:d34d9f189a6773e7239551eb169c844cdb7267558348ec50f3dee49d7ee3653a","observation_id":"e0fe818e-9ab4-42ea-a4cd-e75b9c450f5f","resolution":{"observed_at":"2026-05-19T10:52:15.275082Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05762","last_updated":"2026-05-14T17:01:38Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T21:37:47.215709Z","submitted_at":"2025-06-06T05:41:33Z","title":"BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":28,"verified_fuzzy":7},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 2 inbound Pith citation observations for arXiv:2506.05762."}