{"as_of":"2026-08-10T01:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f4a4ddbef36232172922c02e7c2648f4e0e1d2e8987501203180544626b66f02","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:57:03.522756Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.20417/citation-record","integrity":"/paper/2506.20417/integrity","json":"/paper/2506.20417/citation-record.json","paper":"/paper/2506.20417"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.713004Z","title":null,"venue":null,"work_id":"ec477cfe-7783-415b-a4e5-0701c1653abc","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:57.633395Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:35975fde770ed5f6d3575190357e0a720b01e9450882ae4300f7acf28e30395d","observation_id":"7a38e721-871f-43b6-ac90-ea2910f6d4af","resolution":{"observed_at":"2026-08-06T22:57:05.715618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.705483Z","title":null,"venue":null,"work_id":"38705356-9900-4409-9fc2-768630ddb308","year":2009},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:57.810272Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:e6b762b4340b9d8c91079a71fa4716bd113673f6d5d867c13ccfe1d5aac1e2ce","observation_id":"1797a8df-eb06-4410-bcf8-af5ea3d3cdb3","resolution":{"observed_at":"2026-08-06T22:57:05.708002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.697115Z","title":null,"venue":null,"work_id":"bcbeaca6-ccac-4414-8227-2f0875fcd60c","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:57.989631Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:d6980a3d4ec478bcd68a1aee0e1b9e87b7141e3c7af6774f8634065c455b76d9","observation_id":"13450a5c-d853-4bc1-a57c-6fd0d29aa131","resolution":{"observed_at":"2026-08-06T22:57:05.699994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.689058Z","title":null,"venue":null,"work_id":"da114514-72ff-4d28-bd67-e974b04fc3ff","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.126029Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:8598ac803bfae5b95e4b2fb316192b75a3d42ee8fe641fc2787abe7d643ee9a0","observation_id":"57a79dfb-ef3a-4307-a7af-b87352a9f1dd","resolution":{"observed_at":"2026-08-06T22:57:05.691760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15332","last_updated":"2024-12-20T09:20:16Z","snapshot_observed_at":"2026-07-06T18:19:13.078606Z","submitted_at":"2024-05-24T08:13:16Z","title":"Cross-Validated Off-Policy Evaluation","version":4},"cited_work":{"arxiv_id":"2405.15332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15332","snapshot_observed_at":"2026-08-06T22:57:04.120752Z","title":"Cross-Validated Off-Policy Evaluation","venue":"cs.LG","work_id":"5f8f3f18-2732-47ac-9860-eb9f07817d8f","year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.295624Z"},"links":{"cited_paper":"/paper/2405.15332","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:d55ee87e57679ad073d8437ab0511c6583418b01ace989c4c5ee85b134766600","observation_id":"6920de63-2a90-485d-a252-e05d8850b738","resolution":{"observed_at":"2026-08-06T22:57:04.256505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.680811Z","title":null,"venue":null,"work_id":"e352cf42-270a-4705-8c61-275968ef638a","year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.433736Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:aa26dfc26fd7a7d0a87b8a89af297eec38519f79f369c36c12f868b3a8c4a54f","observation_id":"7d2039fa-6850-4858-8616-feca19337c44","resolution":{"observed_at":"2026-08-06T22:57:05.683711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:58.549891Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.549891Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:9a77c0a6941ce32c1ad84d4b95ad0733691ef7d87d828b053aeb7e5d37ccfc03","observation_id":"513edc90-41ba-450d-b7e3-dec5c407efdd","resolution":{"observed_at":"2026-08-06T22:56:58.549891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.667420Z","title":null,"venue":null,"work_id":"fcddbd61-a9b6-4791-b194-3e25f4c289bc","year":2011},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.713995Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:5063c9be1a1c422cfb142c518f4e50fc886beebf8dfa4c1c97a556273a1bb9a3","observation_id":"fffb9fdd-9ae7-42ee-a6d8-d00dd5341ef1","resolution":{"observed_at":"2026-08-06T22:57:05.670350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:58.832672Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.832672Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:6dc8604f74029fbcf5616d0198689837d4ab9cb3ff2a10728043145b63f130e0","observation_id":"1a8c6af5-dbbd-46b2-95d1-df8978b08d68","resolution":{"observed_at":"2026-08-06T22:56:58.832672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18022","last_updated":"2024-11-09T19:06:18Z","snapshot_observed_at":"2026-08-05T16:57:02.954854Z","submitted_at":"2024-06-26T02:34:48Z","title":"Automated Off-Policy Estimator Selection via Supervised Learning","version":2},"cited_work":{"arxiv_id":"2406.18022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18022","snapshot_observed_at":"2026-08-06T22:57:03.802338Z","title":"Automated Off-Policy Estimator Selection via Supervised Learning","venue":"cs.LG","work_id":"ce1ed56b-c69b-449e-a0d4-678353862acd","year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.998267Z"},"links":{"cited_paper":"/paper/2406.18022","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:f70f9e2335e4224145408d1a2b7538c0f8fdec65b286cdf0ac4d8da8c4284c14","observation_id":"9eb99c06-21db-452b-a734-7f91be1bb0be","resolution":{"observed_at":"2026-08-06T22:57:03.921229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:59.125604Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.125604Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:b8190a1115e9090012e6a2a9228c887e72b252a88cd551079d43ea6568eec66a","observation_id":"e6fa3fcc-de25-4553-b9bc-7f9e48374958","resolution":{"observed_at":"2026-08-06T22:56:59.125604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.649350Z","title":null,"venue":null,"work_id":"c257ec9d-e859-4bc5-aaab-c8e14884bb1e","year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.244227Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:0ab0931727d1f584f48ceffd2b79e7174c1c14b6395fa2df6e8375538f850b6f","observation_id":"8e463d8c-b6ca-4614-b687-f5b7ab8085f9","resolution":{"observed_at":"2026-08-06T22:57:05.652138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:59.515223Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.515223Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:0eea5735d7586a1eadfac3ca546c0393b505cf621339af9ff6944615d2fb2110","observation_id":"3841481f-b8d6-4e40-85eb-14e1c123fd65","resolution":{"observed_at":"2026-08-06T22:56:59.515223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.627557Z","title":null,"venue":null,"work_id":"fa977c38-7807-4caf-8a5a-0457e7298547","year":2019},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.693597Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:4d00cdb010435ce9803eedeab65e4679258958ca611ef310ce1764bd4428347c","observation_id":"ac7e9870-5179-4ffd-859e-8c4267110d56","resolution":{"observed_at":"2026-08-06T22:57:05.630603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:59.894459Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.894459Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:4d7a2130e12f10a7236d405f1a54c372c9bf3eeef540cef5ed81aac4bfac02d7","observation_id":"7e475c0c-da1f-4d98-a90d-7ec85f7f7701","resolution":{"observed_at":"2026-08-06T22:56:59.894459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.614274Z","title":null,"venue":null,"work_id":"a34a9510-cdab-4cdd-a6db-440331826115","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.090532Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:687f2f2c0466c8233f397868a9614abf8df40cf8ac5de9c7509c0269a3a3874d","observation_id":"c0a246a2-f96b-4f77-9ec5-f1fbdb4325b1","resolution":{"observed_at":"2026-08-06T22:57:05.617187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.606419Z","title":null,"venue":null,"work_id":"22c457dd-5a51-453d-9ffc-738a2bb853e4","year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.200325Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:585dfbaac63a0a4b9ab705dc36c6fd766767912296018e288db2ce3aadec4b3a","observation_id":"65255918-bc4a-4142-9466-f406fce52be7","resolution":{"observed_at":"2026-08-06T22:57:05.608866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.598581Z","title":null,"venue":null,"work_id":"6aa80fad-5736-4f67-81fd-059c6e342450","year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.320728Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:4c76c2cf9a4009bacb9b1c36d4c4af70b0a2fa00521fe886590fc73dd88d537a","observation_id":"54d46434-14cd-4144-88c8-9f2254ef44ec","resolution":{"observed_at":"2026-08-06T22:57:05.601347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:00.475158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.475158Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:217dbc41d1b96c1813a08cf5b33a502132c29782f9dc5ef30137e1370fd2be21","observation_id":"6d31b4b8-46b9-449e-89fb-b1aef7746119","resolution":{"observed_at":"2026-08-06T22:57:00.475158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:00.582426Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.582426Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:f57f37dde22dce62e159e27caced43c5eb21b1646e6905c351e2c153904ae466","observation_id":"7a7379a9-39fa-4113-bb56-7684bacfad56","resolution":{"observed_at":"2026-08-06T22:57:00.582426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:00.654383Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.654383Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:eb74d289960d99acba87e4a3d3edc9cb2d738779f9cc4b5226c75387909df9df","observation_id":"c94dddf8-91a3-4600-bad7-79d50a71ba34","resolution":{"observed_at":"2026-08-06T22:57:00.654383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.574974Z","title":null,"venue":null,"work_id":"8f6aa965-4d6a-48e4-99c8-14ddd37dc4ee","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.710113Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:9a6dcb5ac5eb36fb9cd15920c2eced90641f6f05105052121c009ec96923a3eb","observation_id":"245faf78-2d3e-4a15-bcbf-e643103507e9","resolution":{"observed_at":"2026-08-06T22:57:05.578009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T22:57:00.795708Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.795708Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:6e4813fa1b88e0fed19bc8c65404b1512ad1a2fa24ba62aee6bc09241f614624","observation_id":"fc193ca9-8e19-49df-bb06-14df702d675a","resolution":{"observed_at":"2026-08-06T22:57:00.795708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01707","last_updated":"2025-01-03T23:17:28Z","snapshot_observed_at":"2026-07-06T12:43:38.893285Z","submitted_at":"2022-03-03T13:30:28Z","title":"Testing Stationarity and Change Point Detection in Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2203.01707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.01707","snapshot_observed_at":"2026-08-06T22:57:03.568486Z","title":"Testing Stationarity and Change Point Detection in Reinforcement Learning","venue":"stat.ML","work_id":"0eb4fe3d-96aa-4b65-8a51-c51713627eb2","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.903644Z"},"links":{"cited_paper":"/paper/2203.01707","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:c03987a38b771a41edf7c239d34501f6c30d7451e5fbc943205e9d2f6cd0903b","observation_id":"b046382f-2629-4764-824b-c02e8f13d550","resolution":{"observed_at":"2026-08-06T22:57:03.677587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11431","last_updated":"2023-04-26T22:49:15Z","snapshot_observed_at":"2026-07-06T14:33:47.984474Z","submitted_at":"2022-12-22T00:47:40Z","title":"Local Policy Improvement for Recommender Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11431","snapshot_observed_at":"2026-08-06T22:57:00.977506Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.977506Z"},"links":{"cited_paper":"/paper/2212.11431","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:86331adc5d60b3c1542360f70ba4449b1d03292be7ecc8cb9ded9cc428cbc5a2","observation_id":"e8ec04c3-8ef5-42d4-bead-b231f39e9ca2","resolution":{"observed_at":"2026-08-06T22:57:00.977506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.092625Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.092625Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:2da18bfdb1f0b22c610f86663979f81e84c5234bd051685335876f77ff31554a","observation_id":"f1da69d0-e516-4dec-ab2d-276f32c8fd83","resolution":{"observed_at":"2026-08-06T22:57:01.092625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.560420Z","title":null,"venue":null,"work_id":"ceff7c08-a5d0-4dc5-b4f8-00d8980f9a28","year":2023},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.172573Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:e9efcce4e64dc9262881ad7da1f6f8d0b2b81a29777abb9ec652f1630a85b654","observation_id":"1cf3c544-0743-4307-8f1d-364003c8273b","resolution":{"observed_at":"2026-08-06T22:57:05.563972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.246452Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.246452Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:025256527cfdfbe590448507e89c1cbd9419a2ab3f0e49e1556c2bc5e6fff08e","observation_id":"5ef6d503-7703-49ab-9b8a-fad721dba071","resolution":{"observed_at":"2026-08-06T22:57:01.246452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.314297Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.314297Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:8adb40bab13dbb1246cf0d75c310db716b8f5ef9451d9ca0e2850cad392d1493","observation_id":"2155d7b1-120e-4279-a21e-1dd69aa3f505","resolution":{"observed_at":"2026-08-06T22:57:01.314297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.541973Z","title":null,"venue":null,"work_id":"5f42a283-b616-4395-a0e9-96d2dde53a35","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.391181Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:f7cb6d3ea93cc5fe29cae61687f5d2cfda8d267d0d0e08d48c0f1858f364eb4f","observation_id":"71f424e0-70fe-42fb-a7ae-4fd0ddfae6e3","resolution":{"observed_at":"2026-08-06T22:57:05.544804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.533739Z","title":null,"venue":null,"work_id":"3ddc8ac7-5b49-4676-aecd-5d0abe808953","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.453082Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:3f7d50545b6caf5bf576469932d216be54f07254fc943ce3a29659d5b51b92f7","observation_id":"30070b5a-40fa-4438-aaaa-51c7456a865d","resolution":{"observed_at":"2026-08-06T22:57:05.536544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.543532Z","title":"Sutton, and Satinder P","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.543532Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:11fa48a091373d9aa0e1682879ab9b8e204f211aa6a6fc34c37ee2b26b5328fc","observation_id":"a4564b96-805a-4ca4-bd8f-b7d8cec09bd9","resolution":{"observed_at":"2026-08-06T22:57:01.543532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.520215Z","title":"inverse probability","venue":null,"work_id":"a8c045ed-e1c5-4b0a-a173-cfe96d4086d3","year":2007},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.638449Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:73498ab2aa2013cbec301d4359cec942aa262eff4d39a0e3cb6b190a8e476e29","observation_id":"d91747d7-f820-4545-9302-9b501ccaf606","resolution":{"observed_at":"2026-08-06T22:57:05.523544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.721600Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.721600Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:85d0e1270615320050a7a213343039a49e2ee1bc5198346927fee00bc8f3ad7d","observation_id":"653475e5-b502-4992-9590-b8f810e18c13","resolution":{"observed_at":"2026-08-06T22:57:01.721600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.791366Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.791366Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:edf2219b96b3308cf532475785908a0a46e2e894b326e303651939d1fe6a4a61","observation_id":"d6bf71bf-de55-46d4-8072-044ee656579a","resolution":{"observed_at":"2026-08-06T22:57:01.791366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.912242Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.912242Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:f3796a85da49a55056c2eaccf541c2ab5ca44150adeb7045ba5dafc14a3d5305","observation_id":"1ab34c7c-65a1-4ab6-8b5c-52264937b0ee","resolution":{"observed_at":"2026-08-06T22:57:01.912242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.997347Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.997347Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:e29c8a1bbf1b86072f2ace4789a156a5afa5998b330db74a3b255ff5ad619f08","observation_id":"05d63646-3ca7-4843-bac6-c9bc9fefe076","resolution":{"observed_at":"2026-08-06T22:57:01.997347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.082541Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.082541Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:addb52b50c730bf59d835c3afd725adac2b6999e60c01f4633fef658ca660a05","observation_id":"f4a368c6-48b0-4142-a0f7-906dda4579ec","resolution":{"observed_at":"2026-08-06T22:57:02.082541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.145542Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.145542Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:5c047e5f0cc629f043e3d6c22733867f09408caccba5fbf0b5fa5b7f403e6c9b","observation_id":"8949826d-6691-4fe8-8980-95a1136c89b5","resolution":{"observed_at":"2026-08-06T22:57:02.145542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.471823Z","title":null,"venue":null,"work_id":"7b41bb27-21e0-46d3-b7ae-5d5c120706fa","year":2023},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.273232Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:539326e6b1426c4f876e007a664320414d5af1f106fb4f34adb2e008993f54b7","observation_id":"fe2e02e4-cb91-4ed3-ba53-303543d61207","resolution":{"observed_at":"2026-08-06T22:57:05.475414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06151","last_updated":"2024-02-09T03:01:13Z","snapshot_observed_at":"2026-08-08T22:28:02.575519Z","submitted_at":"2024-02-09T03:01:13Z","title":"POTEC: Off-Policy Learning for Large Action Spaces via Two-Stage Policy Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06151","snapshot_observed_at":"2026-08-06T22:57:02.351653Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.351653Z"},"links":{"cited_paper":"/paper/2402.06151","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:dbe15d694d138c7817311ba8efb1e1f88f082c945a3f25808f842e87ce5104fc","observation_id":"a92756f7-96e3-4e62-83da-710d9825610c","resolution":{"observed_at":"2026-08-06T22:57:02.351653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.461807Z","title":null,"venue":null,"work_id":"7158096f-dd87-4f93-85a3-322fe3b8a342","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.413584Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:ac191b177f12592a629db430999fc109499d96151c90cde9b91dc16eec60f75e","observation_id":"ad851038-0e81-41bc-9dc3-bc6a6024aafc","resolution":{"observed_at":"2026-08-06T22:57:05.466278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.498869Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.498869Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:ae3893e38e6191e93a32da83c119e5a30dbab379fb3378e69a999c2c4e0658ca","observation_id":"a1b2ba21-75bc-4f9f-aa35-ba428afdb874","resolution":{"observed_at":"2026-08-06T22:57:02.498869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.448341Z","title":null,"venue":null,"work_id":"a8362a04-9581-495d-92fa-dc6ad3e3c71b","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.574009Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:60240cc312d39cc233021bd4378308f7ec703288d691ee4dbab4d61dd7aec8d4","observation_id":"bc435e51-f6c6-4561-b086-0e7b2d5c8b35","resolution":{"observed_at":"2026-08-06T22:57:05.450909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.707484Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.707484Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:c6bc18c2da184edcd8d653c710e5002fd5d1a5ac81e4918fe6c4f3c900d653b7","observation_id":"188fabf3-9293-4ece-8719-9a41ad25a02f","resolution":{"observed_at":"2026-08-06T22:57:02.707484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.777345Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.777345Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:556713f7866e98b4d182832f76805e97308ba7654123132bd1b6272fb70cc3cb","observation_id":"577d14ae-95f2-4160-bec8-ccca0ace4820","resolution":{"observed_at":"2026-08-06T22:57:02.777345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.429231Z","title":null,"venue":null,"work_id":"21919e8e-664f-4251-be58-28102336aee0","year":2016},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.876364Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:c1072a1e61bd9ce246719fa6b5df7b13a0c3aff74164a2b0b1c22a1f6674f2ac","observation_id":"1ffecbbf-d644-436d-b68f-2369436c1f23","resolution":{"observed_at":"2026-08-06T22:57:05.432061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.420328Z","title":null,"venue":null,"work_id":"f6dd7da7-7841-4afa-8898-28a6e2d3c768","year":2017},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.943163Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:f6c3e88e5abd091ec6fc480c897697d51193b2121bb166dff30c56bcf302ecd9","observation_id":"c1d47038-761e-4d1d-b19d-e2af3d0908ec","resolution":{"observed_at":"2026-08-06T22:57:05.423259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.410847Z","title":null,"venue":null,"work_id":"9095d493-1968-46b3-a415-2534d801c884","year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.016528Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:15f43614431fa1714287a70913485399ade6b010120f5fae38bb44377a14c223","observation_id":"76418d30-3e10-43dd-b951-133556f01d89","resolution":{"observed_at":"2026-08-06T22:57:05.414813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.402468Z","title":null,"venue":null,"work_id":"63947aa3-49e8-4ae9-b6c1-b8fc8f5a61ff","year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.094153Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:b0aca7a3efb26289f0d90b1c5fad3589c661dab1306fcd430b74627d7e587353","observation_id":"f974a6ae-0a21-4d3c-974a-75461d65131f","resolution":{"observed_at":"2026-08-06T22:57:05.405166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:04.921060Z","title":null,"venue":null,"work_id":"c12b6216-aaa8-49b7-9ffa-2e7febe00dea","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.270347Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:a19dc6f6bccae22b7f290a0e6a1126e6da6e8b8d93ba00b05122043456d07a1c","observation_id":"ff9a95c1-5dc3-4de2-8bf9-9c4e0951a7ed","resolution":{"observed_at":"2026-08-06T22:57:05.017822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:03.346359Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.346359Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:c3d5d63192b6e20c80f27723d24734b034228277a895736304c5c5718cbe68fd","observation_id":"73effc61-ca3a-4722-bae5-7dc6feee567e","resolution":{"observed_at":"2026-08-06T22:57:03.346359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:04.623294Z","title":"\" Is it applicable to abrupt non-stationarity?","venue":null,"work_id":"b7b83b31-baf8-4348-b450-a91379ac993f","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.428079Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:6aed9e4f4ecffc561ba2dbf1aaa7d6192b064392894c1251cc46f79a18b80e1e","observation_id":"6fed49a8-a581-48e0-ae14-5e6575a8e5d4","resolution":{"observed_at":"2026-08-06T22:57:04.754232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:04.400336Z","title":null,"venue":null,"work_id":"2500519a-5bfd-4594-b291-88a3f7c84735","year":2025},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.522756Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:ccad62796438b8da20eade62554bf2d584bb5fd30dd283440257fcf1f32f34d7","observation_id":"71747ba9-66b0-4b09-a5fe-9f64daf8d7ea","resolution":{"observed_at":"2026-08-06T22:57:04.553602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.640739Z","title":"InInternational Conference on Artificial Intelligence and Statistics","venue":null,"work_id":"fa83a346-0bed-4ab3-a4b6-21ac4b42075e","year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.382834Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:2d20cff62581e20262d0b81c4c2861e88eb2085e0e355aa6c51f403a1c6053f2","observation_id":"f670b0fb-7e4f-449b-bbd4-b098449d78c5","resolution":{"observed_at":"2026-08-06T22:57:05.643855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.150026Z","title":"InProceed- ings of the AAAI Conference on Artificial Intelligence, Vol","venue":null,"work_id":"7b9e3702-78dd-427c-b8ef-91bcca3f5e70","year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.177109Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:b51c1f042fb4d6e9ca1e25cf2be485a9650ebe3bac47a57d8ea1159b86134cf9","observation_id":"a782623a-5343-4a44-b302-1a49613acc72","resolution":{"observed_at":"2026-08-06T22:57:05.271540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.501585Z","title":"In Proceedings of the ACM on Web Conference 2024","venue":null,"work_id":"795b30a5-6494-4901-ac2e-028938364f75","year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.838358Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:64870d7bdc840e3546e25d80ed67ff072aba3bfa29068f3502def9a350024a89","observation_id":"760a0fa8-59c9-40f1-bc5c-b6a9b5c8ab94","resolution":{"observed_at":"2026-08-06T22:57:05.504191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T14:15:43.315375Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":3,"verified_fuzzy":5},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2506.20417."}