{"as_of":"2026-08-07T07:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:faba52e639067f815a73fd74f422be9c70e228c67e121242e33ec25d7966ead7","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T13:42:27.758405Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.16933/citation-record","integrity":"/paper/2606.16933/integrity","json":"/paper/2606.16933/citation-record.json","paper":"/paper/2606.16933"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Distributionally Adaptive Meta Reinforcement Learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:7835448c1d2a2d2fe2536f6c6109ce7ee75b85472c8af59b396c04d6afc58947","observation_id":"47b5363a-e73a-44f4-ae7a-491e2ce5eb22","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2023/380.url:","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:48:51.128413Z","title":"CROP: Towards Distributional-Shift Robust Reinforcement Learning Using Compact Reshaped Observation Processing","venue":null,"work_id":"beabe6d5-3b89-4caa-970f-f6de03acb159","year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:5354208f2a9a691ea49bc270efab32918cc0f6a1a94197087615a9768c008f1f","observation_id":"783730f5-d722-4c2e-bed3-545879dbbb96","resolution":{"observed_at":"2026-07-12T13:48:51.130067Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10846-023-01917-z.url:","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:48:51.057472Z","title":"Smooth Q-Learning: An Algorithm for Independent Learners in Stochastic Cooperative Markov Games","venue":null,"work_id":"94ca14bf-1687-496c-9bb4-85a07ac64bbf","year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:d98bd247e8dcea56456a3d53241903a9f96595b0eb03de563a60f069ca3dfba4","observation_id":"457cbc1f-2182-4f6f-a868-c0d3ed20dae6","resolution":{"observed_at":"2026-07-12T13:48:51.059207Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Optimal Control of Markov Processes with Incomplete State Information","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:25a211f4fd41a74d122caf6c6b072033a750caafbc66e1835f9fd5e3bc528f02","observation_id":"02419380-0459-464f-81d5-0b7da178971b","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:0a41fe971fe7cb13294433288313adb35ceacdce0775f57e29d8122a6b4c6adb","observation_id":"f8c9c544-66ca-4473-9e4d-22008c2b8c26","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:599b0200cf74979dfeb0b75c8c909fb5c974ebc1341f82126812cea926027800","observation_id":"6db16b8c-5030-40f9-b1c8-2c7c846815d2","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Foresight Distribution Adjustment for Off-policy Reinforcement Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:47cfd8649db9b4fe55e10b1d6e54438d60f158e7f2fa919d2a315bc4a9cbc887","observation_id":"fcb29ef8-19f3-4acf-9ef9-bbf81b8d4580","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0633.116077","doi":"10.1145/1160633.1160779","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantifying Generalization in Reinforcement Learning","venue":null,"work_id":"ef1fe72c-f6a0-47c6-84d1-fae0499ac3c5","year":2019},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:f124adb03268dff193408dcf520c94cc02f0b1f4c1f4c7232515062278690e61","observation_id":"f9e05776-c953-49c3-a74b-67742fb7a508","resolution":{"observed_at":"2026-07-12T13:48:51.166650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Györfi, and G","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:84177edb0f990c22c0807916b803332edafbd3e4265778032021f55cfc17a6bf","observation_id":"6bb0f60b-33e3-4935-8374-da8c07ba0493","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"(1990).Stochastic Process","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:165656e1859694b98d6bbf771430a8607d407efb901f51bbce469c41c9698178","observation_id":"c079e2a4-84ed-42ca-838c-c50e7d2f8201","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.127901","doi":"10.1016/j.neucom.2024.127901","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-Agent Reinforcement Learning Clustering Algorithm based on Silhouette Coefficient","venue":"Neurocomputing","work_id":"7ac209ed-a5e0-4647-b2e1-ebd4e6c5098b","year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:e7b622e1baa65d2a63f572d0f46b858fdd2acad00c7f03b30d1bb08ee9740759","observation_id":"6f7d0d77-adf1-4013-b347-bbf815f8aca9","resolution":{"observed_at":"2026-07-12T13:48:51.178385Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.02779","last_updated":"2016-11-10T01:17:36Z","snapshot_observed_at":"2026-08-02T07:58:55.035919Z","submitted_at":"2016-11-09T00:13:29Z","title":"RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.02779","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1611.02779","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:1aaa75089b6463b8c57179cd581893c5bf719dff40d70399126c64c12ae52f75","observation_id":"e97e7202-4a7d-4f09-b4ce-ffc86bb374b7","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Challenges of Real-world Reinforcement Learning: Definitions, Benchmarks and Analysis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:6f47ec607bf6432e4014ffacf885f09911811560a7ea7632ad35c93267bcec94","observation_id":"727b77ea-e18c-44b3-ae3c-ae395a83e926","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-06T23:28:04.803918Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:9fb99c7934ac4c1cd83e803e04dc797bf6295d62b0f6325f28ccf1d630d1ed09","observation_id":"b635bf3c-5141-4366-8881-ccae312cd0f5","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Non-Stationary Policy Learning for Multi-Timescale Multi-Agent Reinforcement Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:bd314eee22700771af9023af2ca148480aac77af9eab997a9b315a5496ccacc0","observation_id":"3cc624ba-4d2d-48f8-9f0c-7cec765ab696","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Learned Step Size Quantization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:24915802bf39e3aade45f522480defed0bc9830dd87046ba42dd014b9532b91c","observation_id":"aa9a824f-3cd8-4928-a24d-082abf95411d","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.03400","last_updated":"2017-07-18T16:45:29Z","snapshot_observed_at":"2026-08-06T12:29:00.148818Z","submitted_at":"2017-03-09T18:58:03Z","title":"Model-Agnostic Meta-Learning for Fast Adaptation of Deep Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.03400","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Abbeel, and S","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1703.03400","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:08a4f7a51da45fefa360813181b97e51ec25d423333f43ab83dd0e37e743e502","observation_id":"76763311-0f50-470e-8522-c5a015ff6d5d","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03590","last_updated":"2024-02-05T23:50:55Z","snapshot_observed_at":"2026-07-06T17:25:53.950578Z","submitted_at":"2024-02-05T23:50:55Z","title":"Assessing the Impact of Distribution Shift on Reinforcement Learning Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03590","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Assessing the Impact of Distribution Shift on Reinforcement Learning Performance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2402.03590","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:2c98e1f517e7082a5d64cefa8897a82f0039d12e8265b5feafe09c29dd651748","observation_id":"8d353ee0-c613-484e-b641-70cff58ba44e","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Robust Gymnasium: A Unified Modular Benchmark for Robust Re- inforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:eb2683e4f360e5354d3554e1b04a662a7363138ae132e1e1f1d49129c3fc6c31","observation_id":"f1a744b1-3338-42b7-a0ca-83a2adcb592b","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Domain Shifts in Reinforcement Learning: Identifying Disturbances in Environments","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:31795d9c4c7bb283cc395e0c973871df388fabc82c2b835134d86724fd1b0c6c","observation_id":"882e37b2-9b02-41ab-8a46-1343069bfe3e","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09976","last_updated":"2024-07-01T13:35:44Z","snapshot_observed_at":"2026-07-06T18:30:59.857334Z","submitted_at":"2024-06-14T12:37:08Z","title":"Robust Model-Based Reinforcement Learning with an Adversarial Auxiliary Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09976","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Anwar, and S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2406.09976","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:f317c5e6067c072d88fc5c3e137ed956e6ff126082990eff1f6eb9db03f134ed","observation_id":"2e7671e2-a09f-48dc-b7bc-5cba3e678e54","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.129912","doi":"10.1016/j.neucom.2025.129912.url:","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T18:15:00.917874Z","title":"Hybrid Safe Reinforcement Learning: Tackling Distribution Shift and Outliers with the Student-t’s Process","venue":null,"work_id":"888dc632-4646-4004-8ab8-1028c63fb6a9","year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:f0ef42ad1ba420adc0d34e4ed7418ee02cd17f37784f88960b6758cadbfa1f58","observation_id":"aeffa588-f521-43ee-8dda-891f61206bd0","resolution":{"observed_at":"2026-07-12T13:48:51.125261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:2648d7a3313ca53909b471b5a64cf2d55615b49491cc5738319a02f0ef713a30","observation_id":"4823049e-a6bb-4e22-a2a3-dcd22ab581d2","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Quantization and Training of Neural Networks for Efficient Integer- Arithmetic-Only Inference","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:bb09d11639dfe1cd7ebb38b46c6060eeb22c75bd9eed4d1cd329fceb041a8cc2","observation_id":"46dc8be2-5ede-4d62-88f7-7f847ef5cab5","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"I2Q: A Fully Decentralized Q-Learning Algorithm","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:2f53cda69a78503ae8d1692500242a895512ae739df251bcaa0ee3673f5729a1","observation_id":"ac383ae3-79ab-48f6-82f3-daffb69b6561","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"New Reinforcement Learning based on Representation Transfer for Portfolio Management","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:b627e201d395a5252f371c8b3780639626d97603c3cfb978d5ad4c9d01c914f2","observation_id":"9fe71fad-934c-4bcb-9941-fa60532cebdd","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Planning and Acting in Partially Observable Stochastic Domains","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:3cc069741cc04ad674ba0f8610aa075a88f9fa78e5c3fe8bb691a5805c2ba123","observation_id":"0ca19083-de52-44c2-bde3-5d3742bb816d","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1613/jair.1.13673.url:","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:48:51.111281Z","title":"Towards Continual Reinforcement Learning: A Review and Perspec- tives","venue":null,"work_id":"cd17e801-3af2-4750-9ccb-3c39c2a813ba","year":2022},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:535c156e6bd06a974ec844d6174bed8a4306725318e17f984af97eda836ffc20","observation_id":"72942674-2df8-4026-8933-8d5b40438f9c","resolution":{"observed_at":"2026-07-12T13:48:51.112906Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"A Survey of Zero-shot Generalisation in Deep Reinforcement Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:57ab00ed7db6bfb4cbb7a811bdef86641f8e729ac35dbc5d9aad85c4eb6bb279","observation_id":"9529082d-8b1f-4ab8-a044-0c4d4319619f","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Addressing Distribution Shift in Online Reinforcement Learning with Offline Datasets","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:f4d71f2fdcae5e2ae75c9518df60c261650e3a5b549c702691bb624b54fe6e22","observation_id":"54606bb6-8605-439a-8e74-8388d394167b","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:4a5696aa21cf96c94c7b00e1a08056c340d9310d24af39528b8b2b87abf339a1","observation_id":"8bd5293e-45c7-49fe-b4b5-27521384a76e","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Dealing with Non-Stationarity In MARL via Trust-Region Decomposition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:3e39dfc40373ec5d8059a75745f633ec5458047adba485144fa33483daeddc92","observation_id":"c07251c3-0cf0-4d91-a515-83e13869914d","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.13624","last_updated":"2023-07-27T13:13:11Z","snapshot_observed_at":"2026-07-06T11:42:55.121494Z","submitted_at":"2021-08-31T05:28:42Z","title":"Towards Out-Of-Distribution Generalization: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.13624","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2108.13624","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:f2ce977e7623f64017120c0bdb58888aa4e9b72f7c471e1d37c9024397f6a8d6","observation_id":"e8d518ba-e164-44e5-be35-4c73a94ca830","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01315","last_updated":"2022-10-17T16:22:14Z","snapshot_observed_at":"2026-07-06T13:17:01.373088Z","submitted_at":"2022-06-02T21:57:47Z","title":"Sample-Efficient Reinforcement Learning of Partially Observable Markov Games","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01315","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Szepesvári, and C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2206.01315","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:2af90e3c53308c0627aabdae3df20ac56bf02e1ba02e4aa951c0dace402fb6f8","observation_id":"1519ae56-5837-47a7-90ae-b0ac60768d37","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14214","last_updated":"2024-05-23T06:17:26Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T06:17:26Z","title":"A Behavior-Aware Approach for Deep Reinforcement Learning in Non-stationary Environments without Known Change Points","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14214","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2405.14214","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:6714378567b9c0813f8c1d37a9b077fafd92f906c21e21ed45f2281d5c02e48b","observation_id":"543faabc-7470-48dc-8213-e107b3d4fbd2","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Learning under Concept Drift: A Review","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:437c350daaa93f82727c7d557a49fa5d4535a45f4dcfb11c2b7e83c383d3efda","observation_id":"2b5e1157-6bae-4a6b-873f-cd37f2b361ba","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.12830","doi":"10.48550/arxiv.2408.12830.url:","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:48:51.075087Z","title":null,"venue":null,"work_id":"64576822-86ab-416a-9d74-9984536eca28","year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:7f0f0a0181c9c82aa3ab214982c87beda882e147e6a56bc66bf24c56137cfef3","observation_id":"de5051da-97f2-4f58-aee5-c634f11cb75f","resolution":{"observed_at":"2026-07-12T13:48:51.077795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Predictive Uncertainty Estimation via Prior Networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:0aa570c99bba72e9066ff41c62583c83d902932d797fbb895235c038b6b09dbf","observation_id":"6fcaf713-e990-492f-ac90-c8d074a20bdb","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:2bbe4ea65692f2f3d3cdec529eff27b283f10223cde39ad17d8c37e143ea1a2a","observation_id":"a3a8a7b3-88b4-4935-8fa9-a5988ce02329","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3551385","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Taxonomy of Machine Learning Safety: A Survey and Primer","venue":"ACM Computing Surveys","work_id":"87ecac87-8f98-4587-ae9c-6074f2464b95","year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:acb0eb5b24934b5eee7284404b4c6797a642bf87868402436264770d8b57dbc3","observation_id":"414ae4f0-ea1d-4371-8772-b1464673b7e3","resolution":{"observed_at":"2026-07-12T13:48:51.032940Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Neural Posterior Domain Randomization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:41bf5ea750ccb96cdc82d358bca1ffc01d8cfeb79fa2333731f7b50c526745bb","observation_id":"860c35d1-686d-46b2-8647-17f58639886e","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12222","last_updated":"2025-03-15T18:12:16Z","snapshot_observed_at":"2026-07-06T20:53:18.361404Z","submitted_at":"2025-03-15T18:12:16Z","title":"Evaluation-Time Policy Switching for Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12222","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2503.12222","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:f8d550c9b048b56b275c129d302b2e8a339fb4e97259ea0973d8a237ca4e1178","observation_id":"22cd3434-3523-4126-ba71-39be66bfede9","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"(1997).Markov Chain","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:a2b15f08ca9efdb7257784be7338c7b5f7504c5a79433c202ce0c7ac688c5e4f","observation_id":"fa345b52-523f-4986-b0ed-88974be6d6b6","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12282","last_updated":"2019-03-15T17:58:23Z","snapshot_observed_at":"2026-08-04T12:14:43.752072Z","submitted_at":"2018-10-29T17:51:46Z","title":"Assessing Generalization in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12282","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Can You Trust Your Model’s Uncertainty? Evaluating Predictive UncertaintyunderDatasetShift","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1810.12282","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:f2cc9bf1727472ffbc730d3bd1f4cb7941a92ab5e4384a22a8a8327559d20ac1","observation_id":"ebb6d4c2-07d0-495f-9909-21ed69d4c5a0","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"A Survey of Reinforcement Learning Algorithms for Dynamically Varying Environments","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:593ce61ee5bb64d73e9975bcd4ec93cc4e43808a06c0fb582dcd38a1aedf66e1","observation_id":"8d8f18b1-226e-41cb-bcae-6ebbe2efb357","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Reinforcement Learning Algorithm for Non- Stationary Environments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:63365b4c1ea082cb4b4d126a7c78dc25b8d465279b4770ac0fbc3ecbeaa49f26","observation_id":"a8ee2561-0654-4951-bc39-af4930044463","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04773","last_updated":"2025-07-03T18:43:16Z","snapshot_observed_at":"2026-07-06T20:32:43.707713Z","submitted_at":"2025-02-07T09:17:02Z","title":"An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04773","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2502.04773","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:bb6ee80e89f658dec1176259eff32a2a9df47ea3019a80ea94dd77e0776d2112","observation_id":"80c8a8fa-90c6-4ab4-9779-c02b71b7b563","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:ae34cd481b566672eb57d4e34927a90c3485580c1181c577d9df9fd88d8f9afe","observation_id":"7e5c85e9-bf33-477e-aa0f-8022afc32767","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Christianos, et al","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:a01dc6e3c056101cc48a2a4aafa3ecc4c57ed4971ff20c23f8390bc0d4a870ab","observation_id":"f8763d9c-0239-4c1e-be38-5e267389d196","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:35517dd081f662300565b53190eec296bc54fa3fd82306923c499022061e6a6e","observation_id":"d7147912-28c7-4096-b50e-2a241ada46ad","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Efficient Sim-to-Real Transfer in Rein- forcement Learning Through Domain Randomization and Domain Adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:83d8486a52884da0340373eaa9453760f7fd2d58ee4f0889f26a632cf7b5cd5f","observation_id":"ce3cdd11-d481-4d4d-9987-79e79baea719","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:aa06b7ab8b8e712325f0bbc3165ee96837ffc70ee65d9c566b5e2463aa385b2c","observation_id":"414b2650-a485-419c-80fe-6ec33cc23f8c","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03641","last_updated":"2018-02-23T17:27:36Z","snapshot_observed_at":"2026-07-06T06:03:34.004471Z","submitted_at":"2017-10-10T15:00:37Z","title":"Continuous Adaptation via Meta-Learning in Nonstationary and Competitive Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03641","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1710.03641","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:30cd46eb6649f9a1bd50a4ad40eb202f5a7d08217232a52471f8474a1b49eef6","observation_id":"cce31b14-9e70-455c-802d-9b1f1fb1273b","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10537","last_updated":"2020-03-06T09:11:04Z","snapshot_observed_at":"2026-07-06T08:31:39.300566Z","submitted_at":"2019-10-23T12:58:08Z","title":"Robust Visual Domain Randomization for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10537","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"CovariateShiftAdaptationbyImportanceWeightedCrossValidation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1910.10537","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:d0afcf9b320dba67232c228678b1e791a19230a8a9939ef82c8d3e97737520db","observation_id":"42f31156-41a3-4296-8f03-76e8db2bb1f9","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:c021bb9b73d52293a47743b6e8ebb7c1b84dd013ec82d89ac1dfaae2732760d5","observation_id":"66040de8-8d9b-42ef-9cb7-a2cd5e3fcbf6","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.359261","doi":"10.1109/tkde.2025.3592614.url:","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T18:15:00.917874Z","title":"Handling Out-of-Distribution Data: A Survey","venue":null,"work_id":"9d4a881b-1696-422f-9864-fc0b18c1bba8","year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:de1dee797014b3c6271c5f88abbbf768f1e045ebd4e5a57ddd421b38f103c9a3","observation_id":"dc476531-95d1-4ea0-992e-0fbbc451f730","resolution":{"observed_at":"2026-07-12T13:48:51.089964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.104432","doi":"10.1016/j.robot.2023.104432","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DROPO: Sim-to-Real Transfer with Offline Domain Randomization","venue":"Robotics and Autonomous Systems","work_id":"5d14008c-742f-4bf9-a083-f65f0454b45b","year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:588c15529e47220ffd2a50b519fc25f81592c4dff4bdac8e5ee8a04ad9d29919","observation_id":"3db30a77-d503-475a-b6be-ec89398bad69","resolution":{"observed_at":"2026-07-12T13:48:51.066255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Domain Randomization for Transferring Deep Neural Networks from Simulation to the Real World","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:a53a4388ee8b6281648040c25fbe411e60fae31e342a019a48f191d49b1a9ca6","observation_id":"dbc800a9-29e4-479e-b606-c05e978526c8","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/72.788640.url:","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:48:51.047603Z","title":"An Overview of Statistical Learning Theory","venue":null,"work_id":"1a40242a-28dd-4db8-810f-5a8abd79bf3d","year":1999},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:1e4428f079b9863fe79b7a8c8ef4f8759d96bd898511ed19a4b73f0bed334f18","observation_id":"d85be87e-f636-4ad9-839e-13540ca47e19","resolution":{"observed_at":"2026-07-12T13:48:51.049842Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Improving Generalization in Offline Reinforcement Learning via Latent Distribution Representation Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:8ddbdfc69c7de71d0644f1ca5f85168f041f60fa45704a77a86881c791ca6661","observation_id":"22316f80-913d-4e97-9dc0-a50c7916d802","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s40747-024-01421-3.url:","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:48:51.022012Z","title":"Decentralized Multi-Agent Cooperation via Adaptive Partner Modeling","venue":null,"work_id":"eba79ef5-120a-4365-acc8-6a65025cc830","year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:ce0b4b506442b22038f87ef2d9efebb50380e3b8e466d69add3f94f5fd44aeb3","observation_id":"220aa092-ac7b-48f8-8783-3a5679eee3dd","resolution":{"observed_at":"2026-07-12T13:48:51.023637Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Meta-Reinforcement Learning Robust to Distributional Shift Via Performing Lifelong In-Context Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:7a67a3411bd045994fde41008b360ec999dd4efa090e5991a3d35dc4d0b3b67c","observation_id":"77e76c24-8614-4b53-9982-6da806826195","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"RL-ViGen: A Reinforcement Learning Benchmark for Visual General- ization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:84034dd87a702a1cece05bb3e034ab85747e26708042e10f901536b71a4bed1d","observation_id":"71c16c83-89ce-4c49-b045-65c5f24852f6","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Dynamic Belief for Decentralized Multi-Agent Cooperative Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:2c879b260653f274f3d2f0c896b13b29202f88f45ebd4bb7f35464661bf7e750","observation_id":"c0ef0497-98a1-48a0-8cf4-00cbd303f205","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2023/39","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"344–352.isbn: 978-1-956792-03-4.doi:10.24963/ijcai.2023/39","venue":null,"work_id":"451319d2-bf50-4cfe-af96-21ce06fafe6a","year":2023},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:291931c8c46e0fb72d1761ad593c749a2a74536b9d359b83509cce1731041828","observation_id":"5c0c4aa3-4c0e-4d26-b8df-4cd44cbd2bde","resolution":{"observed_at":"2026-07-12T13:48:51.108302Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06893","last_updated":"2018-04-20T16:49:52Z","snapshot_observed_at":"2026-08-04T06:10:10.723883Z","submitted_at":"2018-04-18T19:49:13Z","title":"A Study on Overfitting in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06893","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1804.06893","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:a8216f93be83ece29d8d50fb683df90da34c6d1de1e1beabb0a5012b591021d3","observation_id":"d2bd6856-0909-4d97-b994-56c618838761","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13303","last_updated":"2021-07-08T09:00:05Z","snapshot_observed_at":"2026-07-06T09:59:23.065400Z","submitted_at":"2020-09-24T21:05:46Z","title":"Sim-to-Real Transfer in Deep Reinforcement Learning for Robotics: a Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13303","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Sim-to-Real Transfer in Deep Reinforce- ment Learning for Robotics: a Survey","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2009.13303","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:4f0c09d1962112d70fc0fa9d2aa262a13f729bfb83b678a370acd85675db5fb8","observation_id":"5024bfc2-6323-438d-be1f-c9f132b88d28","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":8,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":13,"verified_fuzzy":0},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2606.16933."}