{"as_of":"2026-08-11T10:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3218828971bbf8b43ef4baeae41767cf65a486039495c4d9d91d30a0412a7c92","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:32:16.181011Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:19:10.654724Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T23:49:14.996703Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04870","snapshot_observed_at":"2026-08-06T21:19:10.654724Z","title":"Chen, and J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00889","last_updated":"2025-07-01T15:55:27Z","snapshot_observed_at":"2026-08-09T13:40:39.694925Z","submitted_at":"2025-07-01T15:55:27Z","title":"Phase Transition in Nonparametric Minimax Rates for Covariate Shifts on Approximate Manifolds","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T21:19:10.654724Z"},"links":{"cited_paper":"/paper/2501.04870","citing_paper":"/paper/2507.00889"},"observation_digest":"sha256:a0c36b103ec21d8111bd716a98d9e8a4d9d78b7ca85b518b7f6abc0afdbaadc9","observation_id":"1c0b5eee-179a-49b9-aa6d-0e3978524b3f","resolution":{"observed_at":"2026-08-06T21:19:10.654724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04870","snapshot_observed_at":"2026-08-03T06:51:17.592951Z","title":"Deep transfer Q-learning for offline non-stationary reinforcement learning.arXiv preprint arXiv:2501.04870, 2025a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.21924","last_updated":"2026-05-23T18:15:37Z","snapshot_observed_at":"2026-08-09T22:15:08.990335Z","submitted_at":"2026-01-29T16:16:24Z","title":"One-Step Bellman Alignment Enables Provably Efficient Transfer in Online RL","version":2},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-03T06:51:17.592951Z"},"links":{"cited_paper":"/paper/2501.04870","citing_paper":"/paper/2601.21924"},"observation_digest":"sha256:ecc111a6c3aff0888c0d8e69ae35fb13104c7047416cb083c6ee3fabb57604cf","observation_id":"3f7af179-139a-430a-b8a4-f82a314dddee","resolution":{"observed_at":"2026-08-03T06:51:17.592951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.04870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.04870","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep transferq-learning for offline non-stationary reinforcement learning.arXiv preprint arXiv:2501.04870","venue":null,"work_id":"8d5438dc-5fae-459a-bbb6-2a07d62e4c97","year":2025},"citing_paper":{"arxiv_id":"2604.28005","last_updated":"2026-05-15T18:39:07Z","snapshot_observed_at":"2026-07-06T23:13:20.516759Z","submitted_at":"2026-04-30T15:27:34Z","title":"Kernelized Advantage Estimation: From Nonparametric Statistics to LLM Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T07:00:32.206081Z"},"links":{"cited_paper":"/paper/2501.04870","citing_paper":"/paper/2604.28005"},"observation_digest":"sha256:f6a4e58b43cbe101696aa82d372de16418343f7983cf1f929b2094ff5276f1f9","observation_id":"d3d7ee4b-295b-4114-af5d-f0fd70ad5b99","resolution":{"observed_at":"2026-05-12T10:16:27.343602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.04870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.04870","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep transferq-learning for offline non-stationary reinforcement learning.arXiv preprint arXiv:2501.04870","venue":null,"work_id":"8d5438dc-5fae-459a-bbb6-2a07d62e4c97","year":2025},"citing_paper":{"arxiv_id":"2604.28005","last_updated":"2026-05-15T18:39:07Z","snapshot_observed_at":"2026-07-06T23:13:20.516759Z","submitted_at":"2026-04-30T15:27:34Z","title":"Kernelized Advantage Estimation: From Nonparametric Statistics to LLM Reasoning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T23:47:53.282259Z"},"links":{"cited_paper":"/paper/2501.04870","citing_paper":"/paper/2604.28005"},"observation_digest":"sha256:26dabf80c62a3b2b2c5728f96be75a5e1c9a7aabaeaa02e081f3910f5266ebea","observation_id":"84e593e0-db75-4a6b-94c9-5b7a2ec81661","resolution":{"observed_at":"2026-05-20T23:49:14.999844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.04870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.04870","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep transferq-learning for offline non-stationary reinforcement learning.arXiv preprint arXiv:2501.04870","venue":null,"work_id":"8d5438dc-5fae-459a-bbb6-2a07d62e4c97","year":2025},"citing_paper":{"arxiv_id":"2605.19122","last_updated":"2026-05-18T21:16:37Z","snapshot_observed_at":"2026-07-06T23:29:52.061489Z","submitted_at":"2026-05-18T21:16:37Z","title":"Dual-Channel Tensor Neural Networks: Finite-Sample Theory and Conformal Structure Selection","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-20T07:20:43.847495Z"},"links":{"cited_paper":"/paper/2501.04870","citing_paper":"/paper/2605.19122"},"observation_digest":"sha256:c7290580c86b77b6cf356471aba518f4ec900fe6df0c10a611583fe22c8c932a","observation_id":"5a3779c5-27b3-4cce-88ee-6f1bf801dfce","resolution":{"observed_at":"2026-05-20T07:23:06.993328Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.04870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.04870","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep transferq-learning for offline non-stationary reinforcement learning.arXiv preprint arXiv:2501.04870","venue":null,"work_id":"8d5438dc-5fae-459a-bbb6-2a07d62e4c97","year":2025},"citing_paper":{"arxiv_id":"2605.19140","last_updated":"2026-05-18T21:48:02Z","snapshot_observed_at":"2026-08-02T02:33:38.613549Z","submitted_at":"2026-05-18T21:48:02Z","title":"Learning to Hand Off: Provably Convergent Workflow Learning under Interface Constraints","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T10:07:03.605952Z"},"links":{"cited_paper":"/paper/2501.04870","citing_paper":"/paper/2605.19140"},"observation_digest":"sha256:e75417dd3ac2b44d36dab46507e0a2f536b8dc2950325cb52023e5ac625b51de","observation_id":"15042302-ff5b-4033-9b07-7f2412602dbb","resolution":{"observed_at":"2026-05-20T10:08:12.160228Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.04870/citation-record","integrity":"/paper/2501.04870/integrity","json":"/paper/2501.04870/citation-record.json","paper":"/paper/2501.04870"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.12570","last_updated":"2024-02-19T21:52:44Z","snapshot_observed_at":"2026-07-06T17:32:32.407814Z","submitted_at":"2024-02-19T21:52:44Z","title":"Offline Multi-task Transfer RL with Representational Penalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12570","snapshot_observed_at":"2026-08-10T21:32:16.109676Z","title":"& Zhang, X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.109676Z"},"links":{"cited_paper":"/paper/2402.12570","citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:dbda4a9105e0413ec1069050244ea7be6adc4558d7a6bc273b480a52194838ab","observation_id":"d0ec2c96-cbe6-47d6-965c-8c40046abc08","resolution":{"observed_at":"2026-08-10T21:32:16.109676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.396941Z","title":"After some algebra we get that ∥ bQp t − Q∗ agg t ∥2 nM,bPagg t ≤ ∥gp t − Q∗ agg t ∥2 nM,bPagg t + 2 nM nMX i=1 (byrwt−ki t,i − Q∗ agg t,i ) · ( bQp t,i − gp t,i)","venue":null,"work_id":"d9ccf2e6-a151-41ba-bee4-98edccc4fc15","year":2023},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.161325Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:aadd4c34b402ea5ff271ff654ae34ea3185a27c72bb1a742a4dcff246590c30d","observation_id":"2caaed7d-f951-4f6e-a72a-c1d286d793d3","resolution":{"observed_at":"2026-08-10T21:32:16.401105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.348586Z","title":null,"venue":null,"work_id":"54d4a9dc-0c8c-4a0a-a644-220b4d045223","year":2018},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.174866Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:0059eba771045636133b3f24e6ff27e1a43bae7c2697b5e5957bd82029e33e55","observation_id":"fcc1872c-9d52-44da-8afe-7255ce3a95a5","resolution":{"observed_at":"2026-08-10T21:32:16.351905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.408361Z","title":"sub-Gaussian random variables with variance parameter σ","venue":null,"work_id":"218fbece-15bd-4f25-9115-a7d30a69ff17","year":2023},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.157923Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:44ec6327aba31628b4e106e86c40ff5d499423ac557c668166e607354833ba73","observation_id":"7575b9fe-bbf0-4a72-bd2f-5b7d84f48565","resolution":{"observed_at":"2026-08-10T21:32:16.413812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.502481Z","title":"copies of z, G be a b-uniformly-bounded function class satisfying log(N∞(ϵ, G, zn 1 )) ≤ v log ebn ϵ for some quantity v","venue":null,"work_id":"b5f1e9a6-3fe6-4418-bd1f-c825736904b2","year":2019},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.154387Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:939e62d66729e3468cf0aa0e158bd8c48d3950c38fe28e6ba05ead7463f0c088","observation_id":"14068bac-a517-45fd-885d-c40053615633","resolution":{"observed_at":"2026-08-10T21:32:16.562749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12759","last_updated":"2023-11-10T15:41:46Z","snapshot_observed_at":"2026-08-08T22:07:07.584450Z","submitted_at":"2022-10-23T15:57:59Z","title":"Robust angle-based transfer learning in high dimensions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.12759","snapshot_observed_at":"2026-08-10T21:32:16.122035Z","title":"& Zhou, W.-X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.122035Z"},"links":{"cited_paper":"/paper/2210.12759","citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:79c15179a9ea6110840ac5efb937a04cfaeddb563eb5a319602cea5288a82169","observation_id":"4c3e234b-a9cc-4f49-8492-0e8e88f5e2a4","resolution":{"observed_at":"2026-08-10T21:32:16.122035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.383932Z","title":null,"venue":null,"work_id":"a63fb8c3-13c0-4b85-ae25-4b7296e8fd0a","year":2023},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.164919Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:5481c0c6d4c6736841808af0ce7fde61ae180a77f24ae4e002377dd316068a37","observation_id":"322b8543-e945-4058-bdad-7302491fa76e","resolution":{"observed_at":"2026-08-10T21:32:16.388060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.372362Z","title":"We now use the peeling argument to extend to uniform r","venue":null,"work_id":"d35c1914-22ef-4c5b-a4e6-c55346a641cd","year":2019},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.168599Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:4b496da1f6b5f124fa4b269bafaed101499b3862715bc9c74d7e0fe79aa1fe01","observation_id":"222c81a9-84bc-42e8-a0cf-3c4dc036e6f7","resolution":{"observed_at":"2026-08-10T21:32:16.376291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.360059Z","title":"For g1, · · ·, gN being an ϵ-covering set of G, we claim that g2 1 − eg2, · · ·, g2 N − eg2 is an 2bϵ-covering set of ¯G","venue":null,"work_id":"c1714da4-17b3-465c-bed7-7b1dcffa3350","year":2023},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.171929Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:ad744265e39ac4c7c277ad054333f49fc462a8b23e5b3a661e5521d203eed82a","observation_id":"13b356e3-f83d-492e-8913-7039e61e011e","resolution":{"observed_at":"2026-08-10T21:32:16.364756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.337433Z","title":"In our dataset, the mortality rate is 24.21% for female and 22.71% for male","venue":null,"work_id":"9369ffeb-0b1d-42f6-baef-6fb4a9be6065","year":2017},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.177942Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:46a606645943264153ce8fc8dc8871762c39a947e4330a456b3156a0d212fa94","observation_id":"393c7740-b859-4d7e-a972-8aecdb99fde4","resolution":{"observed_at":"2026-08-10T21:32:16.341161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.323283Z","title":"Figure 5 in Chen, Li & Jordan (2022) presents mortality rates of different lengths","venue":null,"work_id":"3501471e-6a96-4918-be85-a3e3865d27ae","year":2022},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.181011Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:5144021cb28c66dd9b410b67ca31cef95889535694b419debab55ada16e1182a","observation_id":"7e83532c-c609-4c66-9c6d-a8b9e2d5d5f1","resolution":{"observed_at":"2026-08-10T21:32:16.329149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.581345Z","title":"B., Davidian, M","venue":null,"work_id":"d308f3e9-7114-4f8d-aad8-88d3fdaea4fa","year":2018},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.147497Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:310670ecf89cb33c984078e734b87db477ee410f31afd770bfcd1feffbd6a92e","observation_id":"26bbd280-67f7-439d-b3c7-ea930d053232","resolution":{"observed_at":"2026-08-10T21:32:16.585575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.118274Z","title":"& Remlinger, C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":343,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.118274Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:6fd81c1c481c947e77afaac55c3464bc986ab47a8e54c5c8a23ca89fce183181","observation_id":"bba30a7c-7f58-49a8-8c84-50e975fb6d42","resolution":{"observed_at":"2026-08-10T21:32:16.118274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.592595Z","title":"& Song, R","venue":null,"work_id":"f2c81370-a2cc-420c-8573-522a94a02599","year":2022},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":640,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.138500Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:7f469d68790e9a0a2f5222a3cc96b77cb4120e9bec318328a09dd76d5e10a8cd","observation_id":"a019a3d5-0491-4d7b-becc-8ee33a89f447","resolution":{"observed_at":"2026-08-10T21:32:16.596606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.627347Z","title":null,"venue":null,"work_id":"b40e7ae2-4935-409b-aa49-deab0e3229cd","year":2022},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":651,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.114359Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:10ba9439b985b1c9dfb27cd9f3878f6f8e28f74b9dffe84c8f7f9dc7836847b9","observation_id":"523052cf-28b5-4f18-9179-f93475dfe160","resolution":{"observed_at":"2026-08-10T21:32:16.630880Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10160","last_updated":"2025-07-24T17:59:49Z","snapshot_observed_at":"2026-08-10T03:55:08.128497Z","submitted_at":"2023-02-20T18:46:12Z","title":"Pseudo-Labeling for Kernel Ridge Regression under Covariate Shift","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10160","snapshot_observed_at":"2026-08-10T21:32:16.142623Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":901,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.142623Z"},"links":{"cited_paper":"/paper/2302.10160","citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:3ee83b05452d7cf87a7e21af3e18ed42e63984689655b152bea1524f8acfd0bb","observation_id":"65c1489b-4bfd-445a-b7c5-d722c61da4b5","resolution":{"observed_at":"2026-08-10T21:32:16.142623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.616453Z","title":"(2012), Transfer in reinforcement learning: A framework and a survey, in ‘Reinforcement Learning’, Springer, pp","venue":null,"work_id":"2245c445-77be-4bee-a497-8394e3876e77","year":2012},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":1225,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.126456Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:34c8d621d4e53c933cf86893b05dc69932ee1bb6a39282eaf01e0c0f9d294202","observation_id":"70a0fd0f-6126-4ca7-8351-939c8091aa40","resolution":{"observed_at":"2026-08-10T21:32:16.620368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.570614Z","title":"Deep Transfer Q-Learning for Offline Non-Stationary Reinforcement Learning","venue":null,"work_id":"6a3f04ae-4f7b-4c74-b222-ab6b3345dd64","year":2023},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":1549,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.150696Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:676cf84798bb954701d9dd876e9d1e4eed1a4ffd88bbd0a6ec2a2968f8cd8ee8","observation_id":"6f06d249-26eb-4209-8c26-c81945a89489","resolution":{"observed_at":"2026-08-10T21:32:16.574542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:32:16.604139Z","title":null,"venue":null,"work_id":"80db55e5-03b0-4eb6-82c5-9f06cfca99c5","year":2003},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.134721Z"},"links":{"citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:72bfbbc08df0d1e9c849a949f711430c9ad970ed017e80740409f2ff148c50ee","observation_id":"d174b87b-2a88-4461-8cc9-ae65dc60a418","resolution":{"observed_at":"2026-08-10T21:32:16.609130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08053","last_updated":"2021-06-15T11:21:06Z","snapshot_observed_at":"2026-08-05T22:56:20.287644Z","submitted_at":"2021-06-15T11:21:06Z","title":"On the Power of Multitask Representation Learning in Linear MDP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08053","snapshot_observed_at":"2026-08-10T21:32:16.130092Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning","version":2},"reference_index":3364,"source":"pdf_text","source_observed_at":"2026-08-10T21:32:16.130092Z"},"links":{"cited_paper":"/paper/2106.08053","citing_paper":"/paper/2501.04870"},"observation_digest":"sha256:446c0559761af58d0132da8a363bc1c76c6e77e6b4efc6ac0c2d0e60ebfb9d3d","observation_id":"a80d550b-7804-4b87-a7ab-37bdeb6d35a5","resolution":{"observed_at":"2026-08-10T21:32:16.130092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.04870","last_updated":"2025-04-11T19:09:04Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-11T05:46:32.734699Z","submitted_at":"2025-01-08T23:03:18Z","title":"Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 6 inbound Pith citation observations for arXiv:2501.04870."}