{"as_of":"2026-08-07T19:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:053745348b230bb11c6bcdf0acb2f5ad277a9bc3f56da881e1c467047b5c56dd","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:28:15.475264Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16090/citation-record","integrity":"/paper/2607.16090/integrity","json":"/paper/2607.16090/citation-record.json","paper":"/paper/2607.16090"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:11.644672Z","title":"Sim-to-real transfer in deep reinforcement learning for robotics: a survey,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:11.644672Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:d54fce64d1042fcea620a001f96e12c14d72a9ec87ef13ff3f695960068c9d9b","observation_id":"13e9cff9-cc29-4f1d-93ed-ecb8239ceaf9","resolution":{"observed_at":"2026-08-01T21:28:11.644672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13187","last_updated":"2025-03-08T06:36:16Z","snapshot_observed_at":"2026-08-07T18:08:55.682886Z","submitted_at":"2025-02-18T12:57:29Z","title":"A Survey of Sim-to-Real Methods in RL: Progress, Prospects and Challenges with Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13187","snapshot_observed_at":"2026-08-01T21:28:11.692533Z","title":"A survey of sim-to-real methods in rl: Progress, prospects and challenges with foundation models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:11.692533Z"},"links":{"cited_paper":"/paper/2502.13187","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:039ba98ea4bdc423f8cae5c800994a47dbc754f988b7d46e0b8a610fad8d764a","observation_id":"fab31d8e-7175-45bd-af90-2706d3f1784d","resolution":{"observed_at":"2026-08-01T21:28:11.692533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:11.760684Z","title":"Cross-domain policy adaptation via value-guided data filtering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:11.760684Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:508c781cf304034e950048a2b80da46842195f7cb1309733a9d04f38d8da967f","observation_id":"7e7f6796-6be9-46c2-8694-d8d3763fe008","resolution":{"observed_at":"2026-08-01T21:28:11.760684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15369","last_updated":"2024-05-24T09:06:12Z","snapshot_observed_at":"2026-07-06T18:19:13.078606Z","submitted_at":"2024-05-24T09:06:12Z","title":"Cross-Domain Policy Adaptation by Capturing Representation Mismatch","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15369","snapshot_observed_at":"2026-08-01T21:28:11.858021Z","title":"Cross-domain policy adaptation by capturing representation mismatch,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:11.858021Z"},"links":{"cited_paper":"/paper/2405.15369","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:182cdde2a8c2d00045e59fcfc9f59b07bb3acbdfe0da52c7548efc33440dee98","observation_id":"2cfc9c8d-43dc-45d3-831b-729f463753eb","resolution":{"observed_at":"2026-08-01T21:28:11.858021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:11.970399Z","title":"Sim-to- real transfer of robotic control with dynamics randomization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:11.970399Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:e8727baf7449f76890dda73675dc693a4d78b4b8ff98a380b241ac71a098058c","observation_id":"50ff98de-e947-4a68-a42d-94ae7e3e4413","resolution":{"observed_at":"2026-08-01T21:28:11.970399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:12.083042Z","title":"Active domain randomization,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.083042Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:d945cc249cd8e2875f838b19b980dc52d78bd613d3eed3a079b4f59fc7a31459","observation_id":"42bd4a18-288b-403c-bc35-f0cc644cebc3","resolution":{"observed_at":"2026-08-01T21:28:12.083042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:12.198886Z","title":"Flow-based domain randomization for learning and sequencing robotic skills,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.198886Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:c24999e2d60cf394124e116ce1f88e69fd40157ba2fd0ab5569fda4ee70e685a","observation_id":"86ae8323-bfa1-4ee1-aeb1-4126fb4aec47","resolution":{"observed_at":"2026-08-01T21:28:12.198886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:12.309371Z","title":"Closing the sim-to-real loop: Adapting simula- tion randomization with real world experience,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.309371Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:fb6fbdc0f4071c0497d15da1fb53b4652edd2a6cb23129df03498d785fa14799","observation_id":"05179d9e-a730-49fd-95cb-ca610be47ad7","resolution":{"observed_at":"2026-08-01T21:28:12.309371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-01T21:28:12.466094Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.466094Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:172a5842cb92da2971688012d4fa0fe7c1c8be341dd568d5955834d6d942d27a","observation_id":"81679cff-648a-4f15-821a-0d5323e044cf","resolution":{"observed_at":"2026-08-01T21:28:12.466094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:12.578776Z","title":"Cross-domain policy adaptation by capturing representation mismatch,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.578776Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:1af1d8ff641b695d8949b3252fe1ea79738e3e42138482621f3082420ef26497","observation_id":"c5dffb96-94ba-4fec-9642-e4cea986d45a","resolution":{"observed_at":"2026-08-01T21:28:12.578776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:12.728671Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.728671Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:3f1e96f36c313acf5d68b90384d5c10595a8cd23dd03da35dee23579bbb7d1bf","observation_id":"70a1383a-6958-4460-acda-42b8062bde88","resolution":{"observed_at":"2026-08-01T21:28:12.728671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:12.881843Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.881843Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:1ed6a599d7b67e652fc9003433bebf3427594edc02a41ebe85a1285473dbee10","observation_id":"6ae36b03-ae7d-4ca2-9f8e-184bb1d745c4","resolution":{"observed_at":"2026-08-01T21:28:12.881843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:12.949797Z","title":"State regularized policy optimization on data with dynamics shift,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.949797Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:dc8d1d8e0511e048ddba732f78c37087a57f2fd103527a06c4939c05877005e6","observation_id":"d96018b7-c9d8-4db1-a0b9-c485c7fd7749","resolution":{"observed_at":"2026-08-01T21:28:12.949797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:12.987669Z","title":"Policy adaptation from foundation model feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.987669Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:90a29ee7ea5bbaef6a0307587bec0374d9ef038e6bd66683e924f7db1ea87a52","observation_id":"b210eddf-bae2-4a70-85f0-1bf579aa0b5b","resolution":{"observed_at":"2026-08-01T21:28:12.987669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:13.051080Z","title":"Cross- domain reinforcement learning under distinct state-action spaces via hybrid q functions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.051080Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:126fbb4cced60337eebd167daddb99a4cd2d3aadadc9ea40933cdd3f7868d077","observation_id":"46aba1f9-7ad6-4d8d-a0b3-2dffc0f49207","resolution":{"observed_at":"2026-08-01T21:28:13.051080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10537","last_updated":"2020-03-06T09:11:04Z","snapshot_observed_at":"2026-07-06T08:31:39.300566Z","submitted_at":"2019-10-23T12:58:08Z","title":"Robust Visual Domain Randomization for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10537","snapshot_observed_at":"2026-08-01T21:28:13.118239Z","title":"Robust vi- sual domain randomization for reinforcement learning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.118239Z"},"links":{"cited_paper":"/paper/1910.10537","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:7da2a150858db8d301183f514643bb47c4639744fffbc78433f36f7b5176fd89","observation_id":"2b5cd315-ee7d-4e0f-a8fc-3a4cc7c89521","resolution":{"observed_at":"2026-08-01T21:28:13.118239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:13.173722Z","title":"Variance reduced domain randomization for reinforcement learning with policy gradi- ent,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.173722Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:8e9e8b00fee54ef5cdf9baf639a15151e62963d649569a78ee5299d02c5aee86","observation_id":"29540d56-3d6e-4e2b-814d-73c850e838bf","resolution":{"observed_at":"2026-08-01T21:28:13.173722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11347","last_updated":"2019-02-27T19:23:41Z","snapshot_observed_at":"2026-08-07T15:15:34.263627Z","submitted_at":"2018-03-30T05:47:11Z","title":"Learning to Adapt in Dynamic, Real-World Environments Through Meta-Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11347","snapshot_observed_at":"2026-08-01T21:28:13.233561Z","title":"Learning to adapt in dynamic, real-world environments through meta-reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.233561Z"},"links":{"cited_paper":"/paper/1803.11347","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:fe38b4a1b16c312efa1c2e2ef6276aeef002a4f3bf6b4bc31789430ca9046742","observation_id":"7439fc17-c5ab-4736-86cd-bca1dd95c8b0","resolution":{"observed_at":"2026-08-01T21:28:13.233561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00350","last_updated":"2022-10-01T19:31:46Z","snapshot_observed_at":"2026-07-06T13:58:37.592838Z","submitted_at":"2022-10-01T19:31:46Z","title":"Zero-Shot Policy Transfer with Disentangled Task Representation of Meta-Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00350","snapshot_observed_at":"2026-08-01T21:28:13.303161Z","title":"Zero-shot policy transfer with disentangled task representation of meta-reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.303161Z"},"links":{"cited_paper":"/paper/2210.00350","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:696fa06ebfe41097b376e13e90f47b82bbf37bec080f9ac8754f51cc9d72ccdb","observation_id":"0380270d-a53e-4c38-a3f4-9e8e33d0166a","resolution":{"observed_at":"2026-08-01T21:28:13.303161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:13.394295Z","title":"Cross-domain imitation from observations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.394295Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:78336d70c67597d8186f2806576654cffbf7a8ed4d87c2436faa33131efbfdd6","observation_id":"d53f31fb-cf00-4511-a0dd-5f2313d10432","resolution":{"observed_at":"2026-08-01T21:28:13.394295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:13.502547Z","title":"Cross- domain imitation learning via optimal transport,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.502547Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:9123b85e551b642f3914999fdbafb6c280afe42806944b0199fbd430e2dfd426","observation_id":"6b362640-a724-42a3-a407-843f3a6d3053","resolution":{"observed_at":"2026-08-01T21:28:13.502547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:13.646786Z","title":"Off-dynamics reinforce- ment learning via domain adaptation and reward augmented imitation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.646786Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:54807ee67696eea81f1ace7d9d911bbb2f3f670f8a5e96998ed573c81015dcbd","observation_id":"67647228-1e1d-4f09-8a92-ebc16229d47d","resolution":{"observed_at":"2026-08-01T21:28:13.646786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10765","last_updated":"2024-02-16T15:39:51Z","snapshot_observed_at":"2026-08-07T11:37:35.700606Z","submitted_at":"2024-02-16T15:39:51Z","title":"Policy Learning for Off-Dynamics RL with Deficient Support","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10765","snapshot_observed_at":"2026-08-01T21:28:13.768720Z","title":"Policy learning for off- dynamics rl with deficient support,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.768720Z"},"links":{"cited_paper":"/paper/2402.10765","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:b46bc03bc842a230875e6b9350fea5d705e46514a0ad1e9c3cb1c1dabdbe5bf1","observation_id":"8019d70a-5651-43c9-ad82-224dee2c0b2e","resolution":{"observed_at":"2026-08-01T21:28:13.768720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06192","last_updated":"2024-05-10T02:21:42Z","snapshot_observed_at":"2026-07-06T18:12:22.193554Z","submitted_at":"2024-05-10T02:21:42Z","title":"Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06192","snapshot_observed_at":"2026-08-01T21:28:13.889037Z","title":"Contrastive representation for data filtering in cross-domain offline reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:13.889037Z"},"links":{"cited_paper":"/paper/2405.06192","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:7062dcbeb83aac39db0d0bd61a8938c53666e38b32fbccaefc60ef531eb63a0b","observation_id":"a4535ce1-c27e-494c-bd81-208c3e88a284","resolution":{"observed_at":"2026-08-01T21:28:13.889037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:14.047408Z","title":"Efficient diffusion policies for offline reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:14.047408Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:19ca62ffd8668de3100f93ee6fc4543b856037b4c83c08753eafe085a750e0e3","observation_id":"dbf63394-979c-4e62-8a27-1e15494b9d66","resolution":{"observed_at":"2026-08-01T21:28:14.047408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:14.174342Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:14.174342Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:cc477ac687e6d99874b64c81f6909541397db2f8d0deac8225e5549ba5c928f9","observation_id":"a68fc35b-7b83-46c8-936a-6d6124469278","resolution":{"observed_at":"2026-08-01T21:28:14.174342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:14.314378Z","title":"Synthetic experience replay,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:14.314378Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:74ef96caab2c6e77e574403f267836e7f1b923a0f6f38d62e3e7968ae1ab4d5e","observation_id":"43f281fb-eda3-4d4e-9cb6-9aa444d12aea","resolution":{"observed_at":"2026-08-01T21:28:14.314378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:14.467066Z","title":"Diffusion model is an effective planner and data synthesizer for multi-task reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:14.467066Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:2496d7f5c3e7aeaf241b45d303fcbb723ad4b36dbe3a46a3f426acc59a56197c","observation_id":"27007d8b-332b-490c-9204-4ec514cc0fbd","resolution":{"observed_at":"2026-08-01T21:28:14.467066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:14.587035Z","title":"Diffusion actor-critic with entropy reg- ulator,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:14.587035Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:a39107ebd1b652760438abefa0df8e960c873e78e02fdf6c62fbff2d10c09285","observation_id":"356b4e43-e4d4-4c26-acc5-4208647eba43","resolution":{"observed_at":"2026-08-01T21:28:14.587035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:14.747184Z","title":"Madiff: Offline multi-agent learning with diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:14.747184Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:7be463c8116d61cdc167cf22596fa9e9373fd7f970e2625d0640041034389845","observation_id":"5c31cf64-3ff8-4e26-a5ba-f4149b4bc0d3","resolution":{"observed_at":"2026-08-01T21:28:14.747184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:14.907734Z","title":"Dmc: Nearest neighbor guidance diffusion model for offline cross- domain reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:14.907734Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:85e22a76c9d11882974ccb292955ee00026a2a87c1b1b2ce341100c468c4c5fa","observation_id":"2757a530-bcbb-4643-8c50-4128015baaaa","resolution":{"observed_at":"2026-08-01T21:28:14.907734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-01T21:28:15.011402Z","title":"Soft actor-critic algorithms and applications,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:15.011402Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:fc17090dadc9a134c10ae7225c4ed89b4ec8bf4a8c25ac905b3270f2255fc615","observation_id":"0b793111-8f69-4b03-9f23-ccb2032c7b35","resolution":{"observed_at":"2026-08-01T21:28:15.011402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:15.116585Z","title":"Mujoco: A physics engine for model-based control,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:15.116585Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:52bb45f06cbd799bf15eb331c278e67dfdc591476204b69933986c7876da9309","observation_id":"90530fc7-9249-4445-954b-2708076c0b9e","resolution":{"observed_at":"2026-08-01T21:28:15.116585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-01T21:28:15.252598Z","title":"Openai gym,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:15.252598Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:a1efae8bee48e4ea43c268c06f1cec4fcee650881819fbb9f6c6ada7330705df","observation_id":"83d20bc9-9bfb-4856-82e0-87f2d275face","resolution":{"observed_at":"2026-08-01T21:28:15.252598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:28:15.367574Z","title":"Odrl: A benchmark for off-dynamics reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:15.367574Z"},"links":{"citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:05fdb86bc46e306d0308b2ba2dd50f95dd90d9cefe3c61d8c6a7f20d181772b6","observation_id":"694a93c6-e7c4-4117-8ae2-8028d5a3a2cb","resolution":{"observed_at":"2026-08-01T21:28:15.367574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03858","last_updated":"2021-02-15T17:29:47Z","snapshot_observed_at":"2026-07-06T06:49:27.569841Z","submitted_at":"2018-07-10T20:53:04Z","title":"Algorithmic Framework for Model-based Deep Reinforcement Learning with Theoretical Guarantees","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03858","snapshot_observed_at":"2026-08-01T21:28:15.475264Z","title":"Algorithmic framework for model-based deep reinforcement learning with theoret- ical guarantees,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:15.475264Z"},"links":{"cited_paper":"/paper/1807.03858","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:20bad075fdd8247f5777e6d89b2597e4f10bd5b398a456b718d6317ba8220a80","observation_id":"52c40649-af1c-4ab9-9e9f-74619d1c96a5","resolution":{"observed_at":"2026-08-01T21:28:15.475264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T03:11:28.360362Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.16090."}