{"as_of":"2026-08-18T22:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5280089a39e97822ae0d88b5b63b12cf7b89240e5996132c69964cd13fc97263","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:45:57.643423Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.09114/citation-record","integrity":"/paper/2505.09114/integrity","json":"/paper/2505.09114/citation-record.json","paper":"/paper/2505.09114"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.418354Z","title":"An optimistic perspective on offline reinforcement learning","venue":null,"work_id":"54f17c8e-61d7-41be-a78e-c250e5d41a69","year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.094567Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:2fda6951430cb0b66ff744230e81627d40cdef5c3f7040e0cf9b113d6e321746","observation_id":"d2d44b46-dde9-4eab-b10d-527630770ba2","resolution":{"observed_at":"2026-08-15T21:45:58.423117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.403513Z","title":"End-to-end balancing for causal con- tinuous treatment-effect estimation","venue":null,"work_id":"b4f40a58-79b2-4d1c-9e08-5a9a4a49e875","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.143706Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:350b7da3af31dd79542eab3f59f017e6fd9fbeaa14fa35c6b043601209a5d2bb","observation_id":"117575f0-bbe8-4ae3-891b-970261120dce","resolution":{"observed_at":"2026-08-15T21:45:58.408038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.190937Z","title":"The arcade learning environment: An evaluation platform for general agents.Journal of Artificial Intelligence Research, 47:253–279, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.190937Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:0fa13447f1967c37dbce4fd7493bbbdfc16d93c68ec46800aaa6270e511a2219","observation_id":"aae3d8f4-d6c4-479e-bfe1-0144185ad61a","resolution":{"observed_at":"2026-08-15T21:45:57.190937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.379594Z","title":"When should we prefer decision transformers for offline reinforcement learning? InThe Twelfth International Confer- ence on Learning Representations, 2024","venue":null,"work_id":"12032a3c-baac-41a3-a57d-0fd2b2afbe5d","year":2024},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.231320Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:96100a1d8c9824f3a0b8b34c8e4f31698e8064fd47adce97ad62b39044117a83","observation_id":"ef80db08-2c0d-44f1-8fca-00ca829dc936","resolution":{"observed_at":"2026-08-15T21:45:58.384162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.275467Z","title":"Openai gym, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.275467Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:6566da2d424be6792075296613c86b380b9eb1acf93738c9b938c6b4df8f1beb","observation_id":"5f89db0c-f541-4a7e-b2ed-3ef4b90dc460","resolution":{"observed_at":"2026-08-15T21:45:57.275467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.355088Z","title":"Decision transformer: reinforcement learning via sequence mod- eling","venue":null,"work_id":"67b08d67-365c-4ded-8118-50bceaabdf78","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.280059Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:8ccf615d3c237d957f8762b3fd97064453077841e702b73fb281504e76c93c96","observation_id":"800f8b0b-a043-464d-bf85-1e38c7b6d1d8","resolution":{"observed_at":"2026-08-15T21:45:58.359959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.340420Z","title":"Estimating average causal effects from patient trajectories","venue":null,"work_id":"02e04331-d724-417d-ac7b-ccaa87b6b7d5","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.285376Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:1c7ba608a92285f969f509a5ffd7f3c0d6994dcd8ba9fc60a3a38d6a22cb99b3","observation_id":"792fa787-86ee-4333-bbce-5f1567ad524c","resolution":{"observed_at":"2026-08-15T21:45:58.345271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-16T08:32:46.407746Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-15T21:45:57.289782Z","title":"D4rl: Datasets for deep data-driven reinforcement learning.arXiv preprint arXiv:2004.07219, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.289782Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:b345b839af023183b6558077ff9ff1e1f52f9252b4debb55d0e527d938619d38","observation_id":"c5b24c12-06f3-4219-9494-9c1d99cdf05b","resolution":{"observed_at":"2026-08-15T21:45:57.289782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.325446Z","title":"Cate meets ml: Conditional average treatment effect and machine learning.Digital Finance, 3(2):99–148, 2021","venue":null,"work_id":"45b3c04b-bcd3-4506-865b-7b81f53982d4","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.294571Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:78324671c0a11839171b6a7844ad52cbe39f2319b1854a6da3e23409106672dc","observation_id":"76b8a92b-b8be-4f56-9582-cb6e4e83df0f","resolution":{"observed_at":"2026-08-15T21:45:58.330405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.309296Z","title":"Bounds on the expectation of the maximum of samples from a gaussian.URL http://www","venue":null,"work_id":"bbb64116-3a6e-45a7-909f-8f25e0b2da6e","year":2015},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.298833Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:2ce0c5c30cae58b08cde231e11a2def2e1e44da4023488e791762eb770ac1d6c","observation_id":"6fd0d163-6d05-459f-b0da-899b463d450b","resolution":{"observed_at":"2026-08-15T21:45:58.314464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.293090Z","title":"Morel: model- based offline reinforcement learning","venue":null,"work_id":"615c248f-fc6e-4035-9a3d-fa5fd599fbaf","year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.302993Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:986ca272b4b7484d498a7db00897f438b36b2f9545dd61cd61c28e8a44048c10","observation_id":"dcd2ef1b-2bf2-40fd-86ab-7242aececdc9","resolution":{"observed_at":"2026-08-15T21:45:58.297963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.278303Z","title":"Counterfactually guided policy transfer in clinical settings","venue":null,"work_id":"65a792f7-303f-401a-b55c-20df8dda3ff8","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.307407Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:1f223bb9f22c5c7268640f03c2eaaa054393c17ea6b5218c1fc65c1fd5b3c5f1","observation_id":"9fb92675-9311-4913-9471-edefd8aa8812","resolution":{"observed_at":"2026-08-15T21:45:58.283184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03022","last_updated":"2024-05-30T07:19:34Z","snapshot_observed_at":"2026-08-18T18:52:21.453023Z","submitted_at":"2023-10-04T17:59:32Z","title":"Decision ConvFormer: Local Filtering in MetaFormer is Sufficient for Decision Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03022","snapshot_observed_at":"2026-08-15T21:45:57.311727Z","title":"Decision convformer: Local filtering in metaformer is sufficient for decision making.arXiv preprint arXiv:2310.03022, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.311727Z"},"links":{"cited_paper":"/paper/2310.03022","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:eb1a9af4bbb298d2ec89ecc74e49f6b6353a00df8a3ae54a022d62f20193b309","observation_id":"373d8eaf-5c52-4747-93c2-8bb24f8b7073","resolution":{"observed_at":"2026-08-15T21:45:57.311727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.263847Z","title":"Offline reinforcement learning with fisher divergence critic regularization","venue":null,"work_id":"5955c452-8659-4931-8caf-a04d02c08274","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.316258Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:1a41fbee71cc1f4b5c39b72cb418f1f3de4e7dddb7aa1eaa68080ee54014613f","observation_id":"e9771885-61dd-4e60-a5ba-fe466ed7e4c6","resolution":{"observed_at":"2026-08-15T21:45:58.268442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-13T07:57:56.087944Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-15T21:45:57.320467Z","title":"Offline reinforcement learning with implicit q- learning.arXiv preprint arXiv:2110.06169, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.320467Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:ac2fbe25d74464a4babad03e526ace2a2cdccde51a415affc96e0a8023979543","observation_id":"0d9c5fed-4b50-4551-9f1e-b6e1b263ad0c","resolution":{"observed_at":"2026-08-15T21:45:57.320467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.249572Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":"b7032a06-666b-4059-b5fc-fab97ce317e0","year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.325327Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:f10c1d59d88703506e91730357bc44197ef7580339713e2a582d9e19c4b3cf39","observation_id":"81cf049e-4e23-47a4-898d-54f2cf1861f1","resolution":{"observed_at":"2026-08-15T21:45:58.254106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-15T21:45:57.329726Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems.arXiv preprint arXiv:2005.01643, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.329726Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:a1208120447c2bc95c83a37934396cc3b19ea9aaac1199cebdfcc8d247810a10","observation_id":"80111091-d3aa-489d-93e6-095ace55b2fc","resolution":{"observed_at":"2026-08-15T21:45:57.329726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10551","last_updated":"2020-03-23T21:08:51Z","snapshot_observed_at":"2026-08-16T07:03:49.925895Z","submitted_at":"2020-03-23T21:08:51Z","title":"G-Net: A Deep Learning Approach to G-computation for Counterfactual Outcome Prediction Under Dynamic Treatment Regimes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10551","snapshot_observed_at":"2026-08-15T21:45:57.334288Z","title":"G-net: a deep learning approach to g-computation for counterfactual outcome prediction under dynamic treatment regimes.arXiv preprint arXiv:2003.10551, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.334288Z"},"links":{"cited_paper":"/paper/2003.10551","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:212efb7a38c51ee456915606ec010c238a3f4ccabfcc4a6e942831c3d585c79f","observation_id":"5ee4f5b4-3374-49dd-86d2-d7b456c7f8e0","resolution":{"observed_at":"2026-08-15T21:45:57.334288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.234565Z","title":"Causal transformer for estimating coun- terfactual outcomes","venue":null,"work_id":"04657c37-29ca-47b0-bdce-2f1f3a35bdc5","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.362254Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:e53460da20e5e91a5afeed6a461bc8719125ed023ba3f52e5e054994f354586d","observation_id":"30abaeda-e3e5-4143-b219-b4d26e6415a6","resolution":{"observed_at":"2026-08-15T21:45:58.239703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09464","last_updated":"2021-12-14T13:36:12Z","snapshot_observed_at":"2026-08-16T19:04:53.333572Z","submitted_at":"2020-11-18T18:41:44Z","title":"Counterfactual Credit Assignment in Model-Free Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09464","snapshot_observed_at":"2026-08-15T21:45:57.398711Z","title":"Counterfactual credit assignment in model-free reinforcement learning.arXiv preprint arXiv:2011.09464, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.398711Z"},"links":{"cited_paper":"/paper/2011.09464","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:b82ce9a2ace5ceeaa24afb21ee62727b10ce8cd97fc3e33bbec4343a12cef776","observation_id":"53a78059-1d39-4a53-9846-b2e826e45b65","resolution":{"observed_at":"2026-08-15T21:45:57.398711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.443483Z","title":"Human-level control through deep reinforcement learning.nature, 518(7540):529–533, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.443483Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:da0234999c0b45fcac29b6400d31c942a9ae9b6ef1e5cd8ec37f4f9d1b0d61a2","observation_id":"cda8fa68-50ec-4eed-865b-d8e98fb73bf7","resolution":{"observed_at":"2026-08-15T21:45:57.443483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.209213Z","title":"On the application of probability theory to agricultural experiments","venue":null,"work_id":"d01c8bd3-22c6-4c9e-bb21-bd4cc7103f94","year":1923},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.462227Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:0dad183a1bd91081ae093812cd5ab83e5cadc8f2720337465fe735f0f2843d35","observation_id":"f7afd36e-bbcc-4568-b05e-d94e2d14470e","resolution":{"observed_at":"2026-08-15T21:45:58.214544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.193661Z","title":"The book of why: The new science of cause and effect, 2018","venue":null,"work_id":"df9f896e-17dd-4906-bb86-0cab4ac92aa9","year":2018},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.466811Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:ec0b461fae908e2524eb3aaf16b76824fea92f56bd5a8b0d797242f4b7f8e5c8","observation_id":"84fab8d1-d44b-4ed5-875e-44fc3439146e","resolution":{"observed_at":"2026-08-15T21:45:58.198313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.179408Z","title":"Counterfactual data augmentation using locally fac- tored dynamics","venue":null,"work_id":"b8e281d6-46ac-4596-ae6d-b34cdfc37b07","year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.471125Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:d07b9317de84d877054d135b53c756099c00c95ca1475dfe9325a206f7617e55","observation_id":"c904ce0e-e4c9-4603-b868-4fc375ab7e19","resolution":{"observed_at":"2026-08-15T21:45:58.184095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.164681Z","title":"Mocoda: model-based counterfac- tual data augmentation","venue":null,"work_id":"d190dd90-82df-4290-af97-d0b754e1638e","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.475250Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:28323bbab4d6907c9deafc10160e319160442efe91f8f20b47f42198c87933ab","observation_id":"3c8e1634-bd2a-47e9-bbab-7ccb3ae7b8fc","resolution":{"observed_at":"2026-08-15T21:45:58.169582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.151225Z","title":"Pomerleau","venue":null,"work_id":"8e2dde5c-b57a-4e83-97b1-ee61666d5285","year":1988},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.479296Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:943a6eb6ef2bc7c42ae5f42af0a9016741eda252d1234ce256db1c39e7861c55","observation_id":"081f5425-508e-46ab-a5ff-a179a5de0529","resolution":{"observed_at":"2026-08-15T21:45:58.155576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.136740Z","title":"Estimation of the causal effects of time-varying exposures.Chap- man & Hall/CRC Handbooks of Modern Statistical Methods, pages 553–599, 2008","venue":null,"work_id":"0524db2b-c379-4631-9a1c-2f112cf22825","year":2008},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.483475Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:38bad7dc7c2e08a865bda8e0e25a01b93d2b0eeab388c6d7c8ee4e55c57b4bbd","observation_id":"0b2613cb-3e19-45d2-bd6b-a31c54073a67","resolution":{"observed_at":"2026-08-15T21:45:58.141691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.487915Z","title":"Bayesian inference for causal effects: The role of randomization.The Annals of statistics, pages 34–58, 1978","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.487915Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:88ad7fa902aade74cb353cc8d1398f9d4261df270e4c5b7f51c9ae163f21087c","observation_id":"03b3939f-d879-4f95-8aaa-30c1b355ce3b","resolution":{"observed_at":"2026-08-15T21:45:57.487915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02875","last_updated":"2020-06-23T15:55:05Z","snapshot_observed_at":"2026-08-17T05:48:50.270608Z","submitted_at":"2019-12-05T21:10:08Z","title":"Reinforcement Learning Upside Down: Don't Predict Rewards -- Just Map Them to Actions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02875","snapshot_observed_at":"2026-08-15T21:45:57.492172Z","title":"Reinforcement learning upside down: Don’t predict rewards–just map them to actions.arXiv preprint arXiv:1912.02875, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.492172Z"},"links":{"cited_paper":"/paper/1912.02875","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:2c7b3b9c82c953b7c1512d82f4c10017e2b4b801ce375c5198a006ea93f9aa91","observation_id":"c90fb6fe-a89a-4064-8914-eb02567d1ab3","resolution":{"observed_at":"2026-08-15T21:45:57.492172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.112566Z","title":"Causal influence detection for improving efficiency in reinforcement learning","venue":null,"work_id":"432110e1-b489-4b7a-9963-b3155138fb45","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.497165Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:20561c07a1f7d0cef5d19f539c1fb29d9122829069309aedbae9d3bb06ba6e9d","observation_id":"3c8225c1-5b96-47f0-9e2e-eabebce5e3a8","resolution":{"observed_at":"2026-08-15T21:45:58.117397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.097802Z","title":"Johansson, and David Sontag","venue":null,"work_id":"460aa1a1-368d-4d76-968e-7ee0e718143b","year":2017},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.501380Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:494b457e60af4189383b69546356386b8c08b4bb0581b28bd64323efb0ef7e6c","observation_id":"ab0fe502-da0c-4605-a635-7795ac75d45f","resolution":{"observed_at":"2026-08-15T21:45:58.102289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.505789Z","title":"Mastering the game of go without human knowledge.nature, 550(7676):354–359, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.505789Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:6619d6a13b1580146fb573812657216742f5a6c34690361994d7055d8e9495a9","observation_id":"26cffe2a-0e02-441a-9a70-cdb041f8c826","resolution":{"observed_at":"2026-08-15T21:45:57.505789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02877","last_updated":"2021-09-03T22:15:10Z","snapshot_observed_at":"2026-08-07T04:02:10.973662Z","submitted_at":"2019-12-05T21:13:36Z","title":"Training Agents using Upside-Down Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02877","snapshot_observed_at":"2026-08-15T21:45:57.537078Z","title":"Training agents using upside-down reinforcement learning.arXiv preprint arXiv:1912.02877, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.537078Z"},"links":{"cited_paper":"/paper/1912.02877","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:8b82e6c40810bb5b7e4091f7596e8a042607b84e08e34d8e564244ce6a26a24d","observation_id":"788f03c6-d461-45cc-a387-7cfd7518c8fc","resolution":{"observed_at":"2026-08-15T21:45:57.537078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.073404Z","title":"Offline imitation learning with variational counterfactual reasoning","venue":null,"work_id":"a191d6d6-c609-41e4-87f9-7b74431a7e9b","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.576934Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:8278ddb9a3a5a9d7c282aad63888bcd4bc9a71ee80c75ef149f46e356f243eba","observation_id":"18a38568-430b-4eed-8845-312045a84f73","resolution":{"observed_at":"2026-08-15T21:45:58.077844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.057975Z","title":"Acamda: improving data efficiency in reinforcement learning through guided counterfactual data aug- mentation","venue":null,"work_id":"4d95c46f-73a8-45bf-bbf9-7be45ff40bfe","year":2024},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.581009Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:c1f69a3e72e958d55fa29d0db3598dbc8e2b8f5d2042d3a77c2ce062810ef569","observation_id":"8c9ffa66-79d4-4e7b-a58d-8b3f85d9d7dd","resolution":{"observed_at":"2026-08-15T21:45:58.062756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.585285Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.585285Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:0ad1c97e831f2707722736353181a5f08a2f36433268d0a881145769d7ec650c","observation_id":"8d7802a0-0139-444d-bb95-0c6db934394d","resolution":{"observed_at":"2026-08-15T21:45:57.585285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.032148Z","title":"Learning robot in-hand ma- nipulation with tactile features","venue":null,"work_id":"5ee121ad-b1d2-4081-b1c7-6b37d5a3d347","year":2015},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.589707Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:b4f3e37e16157516d279b331a5bad139dbd31a2942147fab66038a2e50ab2222","observation_id":"1a907807-91c0-4d72-a5cc-88604ac52edd","resolution":{"observed_at":"2026-08-15T21:45:58.036826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.016377Z","title":"Attention is all you need","venue":null,"work_id":"5ec40768-b64e-4e91-bdf8-f3b07ee9b23c","year":2017},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.594046Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:496b72c5a38aed6f99e2bfc543ebdf70398a16fb814d25ff00154a74b205bfc5","observation_id":"2bba606a-837c-46ac-97e5-a0675e19700f","resolution":{"observed_at":"2026-08-15T21:45:58.021676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.001076Z","title":"Supervised reinforcement learning with recur- rent neural network for dynamic treatment recommendation","venue":null,"work_id":"3c09e6f9-dd70-44a8-88dd-f82c3ac04f76","year":2018},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.598527Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:35b56e0313fea0a97783f17c13384e1b0e6745fde22fb4a717397c28f0fd8ae6","observation_id":"447929a3-fb5e-47d1-ba6f-093e71007064","resolution":{"observed_at":"2026-08-15T21:45:58.005796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.985996Z","title":"Elastic decision transformer","venue":null,"work_id":"5c6d21bc-54f4-496b-a0ce-b4869ac03e83","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.602820Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:6b8862e48968971fb666264ca678a10faa052d3682b4869e4b1e2008b5eafa41","observation_id":"9d5b7f94-dbd1-4198-8158-d5ac34177a98","resolution":{"observed_at":"2026-08-15T21:45:57.990473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.970430Z","title":"Bellman-consistent pessimism for offine reinforcement learning","venue":null,"work_id":"86084638-784f-43b8-9103-4f820844316d","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.607052Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:fff246081c3f22efd46251b54d072e18fc0630a8e75bf198f42c2294870c625e","observation_id":"7f73737c-82dc-46d7-8423-974ae99abc2e","resolution":{"observed_at":"2026-08-15T21:45:57.974995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.954963Z","title":"Future-conditioned unsu- pervised pretraining for decision transformer","venue":null,"work_id":"ec3a0e86-aab3-444e-b2a0-d01ddbe065de","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.612101Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:1526848a5970bee7ad3df68945adba7d1770ba5cffeab5e1f2424ebebff780f1","observation_id":"2b0eb0a3-fda8-4f6d-b918-df5934bfc2c2","resolution":{"observed_at":"2026-08-15T21:45:57.960032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.940477Z","title":"Q-learning decision transformer: Lever- aging dynamic programming for conditional sequence modelling in offline RL","venue":null,"work_id":"98284f09-8485-49a9-8db4-8600f231fa85","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.616374Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:02fc897d3465ed4d9a7ad5c797e1c8cbfd5deddd5354a4f4c6ef5d4eec18ff40","observation_id":"bc6dcabf-305c-4f47-a233-877c2d51f59b","resolution":{"observed_at":"2026-08-15T21:45:57.945139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.621224Z","title":"Mopo: model-based offline policy optimization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.621224Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:a48e924196201935c1feaeb043519eaab0b441c56ad9e53cee11415617358931","observation_id":"f5e44b26-1a25-4dc2-8555-8daf95979b88","resolution":{"observed_at":"2026-08-15T21:45:57.621224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10393","last_updated":"2025-07-10T10:09:40Z","snapshot_observed_at":"2026-08-16T14:00:34.506433Z","submitted_at":"2024-04-16T08:48:46Z","title":"Offline Trajectory Optimization for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10393","snapshot_observed_at":"2026-08-15T21:45:57.625464Z","title":"Offline trajectory generalization for offline reinforcement learning.arXiv preprint arXiv:2404.10393, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.625464Z"},"links":{"cited_paper":"/paper/2404.10393","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:361d870a2ac45d4132e5b3c5418adf268636e8dc88ade2429c986538e8bcb65b","observation_id":"a66a1016-3a64-4027-8c4a-a5677185ffe1","resolution":{"observed_at":"2026-08-15T21:45:57.625464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.916898Z","title":"Online decision transformer","venue":null,"work_id":"82224add-ea85-463c-ba99-84ffd6a87b57","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.630023Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:b014d96ddaf100dbb625002837bbd7bb8083949e90fc14e690f221b1983b8ec6","observation_id":"27117b51-9884-4b1c-9596-3d9ac30c2f32","resolution":{"observed_at":"2026-08-15T21:45:57.921419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.902355Z","title":"A boosting algorithm for estimating generalized propensity scores with continuous treatments.Journal of causal inference, 3(1):25–40, 2015","venue":null,"work_id":"d1be3d94-acce-418a-b59d-9cb5187241bb","year":2015},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.634564Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:351304f4c9f19841b996ad12377cd24cf70eb046d6c2bc03db8b537518c97edf","observation_id":"c874b844-8409-4b4b-b8d2-368e6a73cf04","resolution":{"observed_at":"2026-08-15T21:45:57.907281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.887068Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","venue":null,"work_id":"07a27185-8b6c-4681-be7a-2ac373ff667e","year":2024},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.638848Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:c7740c07594a66ceb34a20b480a64697153f8e36cb08e56ce10ff4b2c6ac0120","observation_id":"396a3fce-0880-40d8-8aff-9a97f9e207ea","resolution":{"observed_at":"2026-08-15T21:45:57.892018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5108.8109","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.739165Z","title":"Pearl-style231 counterfactual reasoning","venue":null,"work_id":"337f307d-78b4-4668-a126-d41a89433afc","year":null},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.643423Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:b501422bdbb2692aaa1f8e0d77e01d58713c7c68008a32d81e09057f2abdec01","observation_id":"58e902b8-989a-495f-8b13-a2bfbeac4b7d","resolution":{"observed_at":"2026-08-15T21:45:57.748566Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T15:59:47.887758Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2505.09114."}