{"as_of":"2026-08-09T10:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e87de742cacf2fe4a10e54c2861e3a82715be972ed4ba2a889398610474ba25c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:33:15.689811Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T18:25:58.773053Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-06T20:33:15.689811Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.02762","last_updated":"2025-07-03T16:21:49Z","snapshot_observed_at":"2026-08-06T20:19:15.025932Z","submitted_at":"2025-07-03T16:21:49Z","title":"Contextual Online Pricing with (Biased) Offline Data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:33:15.689811Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2507.02762"},"observation_digest":"sha256:9edd28977491bb4102dabb1d16e9baf45f46888a01803df7b2997433762c5077","observation_id":"2ae15d6c-b760-4c6d-b9a5-4477e796257f","resolution":{"observed_at":"2026-08-06T20:33:15.689811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2605.09183","last_updated":"2026-05-16T18:02:16Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-09T21:48:04Z","title":"Learning When to Stop: Selective Imitation Learning Under Arbitrary Dynamics Shift","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-12T03:27:41.845716Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2605.09183"},"observation_digest":"sha256:14b14b1d832a84c371ef203216c760f762ed6275e429ea977180f0564c075b41","observation_id":"fbdc93b2-1895-476a-9e10-6ac80450243a","resolution":{"observed_at":"2026-05-12T07:21:25.275337Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2605.09183","last_updated":"2026-05-16T18:02:16Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-09T21:48:04Z","title":"Learning When to Stop: Selective Imitation Learning Under Arbitrary Dynamics Shift","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-20T22:04:57.245024Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2605.09183"},"observation_digest":"sha256:2ff97011afa10b0af7b50fd7b2639fde057ded4584eed6daacbde9bd2ba1854e","observation_id":"302631c1-d4b6-4d46-9d8b-5b090a564197","resolution":{"observed_at":"2026-05-20T22:09:07.679623Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2605.22376","last_updated":"2026-05-21T12:09:11Z","snapshot_observed_at":"2026-08-02T19:31:57.676600Z","submitted_at":"2026-05-21T12:09:11Z","title":"Target-Aligned Bellman Backup for Cross-domain Offline Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T08:02:27.951445Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2605.22376"},"observation_digest":"sha256:ad672431e058e9f63b0a71f92700acdc29633bfdb7c4ec040dd1acd30a354a05","observation_id":"6e77fbad-fff3-4457-aa76-8f221709cc93","resolution":{"observed_at":"2026-05-22T08:04:43.160309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2605.24810","last_updated":"2026-05-24T01:44:57Z","snapshot_observed_at":"2026-08-03T02:43:58.048800Z","submitted_at":"2026-05-24T01:44:57Z","title":"Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-30T11:43:41.884049Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2605.24810"},"observation_digest":"sha256:fab15161647a8bd3f88c6192ead8aaaa79082fe20bec427df8e034de724e5e38","observation_id":"cbe75b1d-1b30-4426-92a0-0478b2639b1a","resolution":{"observed_at":"2026-06-30T11:44:37.894007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2606.27475","last_updated":"2026-06-25T18:52:27Z","snapshot_observed_at":"2026-08-02T12:36:42.748876Z","submitted_at":"2026-06-25T18:52:27Z","title":"Support-Constrained RL Enables Real-World Policy Improvement without Real-World Experience","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T01:57:04.293058Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2606.27475"},"observation_digest":"sha256:634a37c061ab5cad1b6b55f341d75170291eef39dd6448aec35dc857fb271e37","observation_id":"62743e01-901b-44b9-a495-564f58cf32fb","resolution":{"observed_at":"2026-07-01T18:25:58.774412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-01T21:28:12.466094Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-08T00:12:47.557262Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.466094Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:f4f9452abf155ffbeff3bfd45462a51c3476dab3f79b9b7cf6ae78d59ba13831","observation_id":"81679cff-648a-4f15-821a-0d5323e044cf","resolution":{"observed_at":"2026-08-01T21:28:12.466094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2006.13916/citation-record","integrity":"/paper/2006.13916/integrity","json":"/paper/2006.13916/citation-record.json","paper":"/paper/2006.13916"},"outbound":[],"paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2006.13916."}