{"as_of":"2026-08-09T20:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:366bc41c35229f687d7c85e372e04bbaa4c4807ca82ace3a0c44f107cb83c54f","coverage":[{"denominator":9,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T03:38:59.132093Z","state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.11720/citation-record","integrity":"/paper/2607.11720/integrity","json":"/paper/2607.11720/citation-record.json","paper":"/paper/2607.11720"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":"Challenges of real-world reinforcement learning: definitions, benchmarks and analysis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:71836c5193412d338e7ce1e23be4e2164ecfeddeb6f3453615d71affaa84d03e","observation_id":"cf787713-fbac-414c-9cd4-06b6d7abddaf","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:72927d81bdf74de3dc89dd6b5fef1fb7ecec7efd35ca86a7f6dc9cddc807ca37","observation_id":"b16bb3ba-187a-432b-b6c3-4dfc1c0901e9","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":"D4rl: Datasets for deep data-driven reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:599996b587cf877dcf94d9406bc1e5541e58c5905c3cca7b53160b3c88eaaeaf","observation_id":"903c7a70-3f74-4544-9807-47af4c8cf6bc","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":"Off-policy deep reinforcement learning without exploration","venue":null,"work_id":null,"year":2052},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:b5ce64994419ea9b08d9054f825c35d91c1de2131d1388de66ffbe4930e51f75","observation_id":"c8e33fcb-4045-4bb5-b639-6cc1fc801d30","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:34e6f0a7e1962b290f9cba571c3eb4f2eaee21b72d86daa686285f726c0f224d","observation_id":"4cca8bbd-5f36-47ed-a544-a46e8586940a","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":"Awac: Accelerating online reinforcement learning with offline datasets","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:0d9a8662a44d58325bb742704a9b5de33af1482195321a95c9beefaa4dd225f8","observation_id":"f13d5a82-ee89-40f4-91c7-4d23058e92f5","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.09055","last_updated":"2020-07-17T15:30:38Z","snapshot_observed_at":"2026-08-09T14:24:01.931120Z","submitted_at":"2020-07-17T15:30:38Z","title":"Hyperparameter Selection for Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.09055","snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":"Hyperparameter selection for offline reinforcement learning","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"cited_paper":"/paper/2007.09055","citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:584d154e2aac8e6507e6bbe19679413bc4ba2c8629f826793f15a7d2e85b637c","observation_id":"e951cdb5-a131-4551-ba6f-3b7b55ee904c","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":"MuJoCo: A physics engine for model-based control","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:3a12230fec1eaa4bf9736357795e00654858bfa941abb87f61642dba26d51d49","observation_id":"204b97c1-63e9-483c-a439-f978eac5ba64","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T03:38:59.132093Z","title":"Real World Offline Reinforcement Learning with Realistic Data Source","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T03:38:59.132093Z"},"links":{"citing_paper":"/paper/2607.11720"},"observation_digest":"sha256:8ab50bc6a63012ba6a50a1aa76d34f1d44aa440e5b87f2717ecf311c44f78d45","observation_id":"633cdd75-afce-4782-a07c-9fe8a503e516","resolution":{"observed_at":"2026-07-14T03:38:59.132093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.11720","last_updated":"2026-07-13T15:46:11Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T00:53:05.652188Z","submitted_at":"2026-07-13T15:46:11Z","title":"Active Offline-to-Online Reinforcement Learning"},"reference_resolution":{"displayed":9,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":9},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 9 of 9 outbound references and 0 inbound Pith citation observations for arXiv:2607.11720."}