{"as_of":"2026-08-16T05:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b7177218838a260c2164bf41c8aa9532512e5f995ad76471820bbaf933d27fe","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:00:35.239845Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.07808/citation-record","integrity":"/paper/1908.07808/integrity","json":"/paper/1908.07808/citation-record.json","paper":"/paper/1908.07808"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.908071Z","title":"SIAM journal on control and optimization 33(6):1926--1951","venue":null,"work_id":"19142455-c726-469a-b47a-ec6bf03acc74","year":1995},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.879122Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:3c57dfc83da5e61cf24c7edc39c5ea03b258ff0b7e777e9f39dff87fcb6c8ed0","observation_id":"a7dac931-384d-436c-9800-50c6a2cdc109","resolution":{"observed_at":"2026-08-14T12:00:36.915132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1111.1797","last_updated":"2012-04-09T10:43:05Z","snapshot_observed_at":"2026-08-15T04:29:38.431873Z","submitted_at":"2011-11-08T04:27:01Z","title":"Analysis of Thompson Sampling for the multi-armed bandit problem","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1111.1797","snapshot_observed_at":"2026-08-14T12:00:34.891992Z","title":"CoRR abs/1111.1797","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.891992Z"},"links":{"cited_paper":"/paper/1111.1797","citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:96a9831a4b393659b182a33a197f5631a10cda93a8c1e5a4af6c1a1f3000a9e9","observation_id":"8975f173-e7cf-4912-ba46-18a115e3e25b","resolution":{"observed_at":"2026-08-14T12:00:34.891992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.851545Z","title":"Springer","venue":null,"work_id":"4b19d8fa-f9a2-49d8-85ed-5dc0b3854fb0","year":1985},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.909861Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:a7c32e95c61005a15e542bc2d6c65c365db19f941f9d32b0a7ab0ab56f96bf3b","observation_id":"0352575e-90a5-4e82-9d44-0d53fd11df69","resolution":{"observed_at":"2026-08-14T12:00:36.864492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.823147Z","title":"In: Proceedings of the Fourteenth International Conference on Artificial Intelligence and Statistics, (AISTATS-11), pp 19--26","venue":null,"work_id":"7212ab39-3989-4725-974b-aca10a2fb99f","year":2011},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.925397Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:a9a7c1729f28e31ffed10c50e58e6c9e888586fd48ce24ff9a7364a64c638826","observation_id":"56730017-92b3-41a3-be4c-a5d3c4fbc459","resolution":{"observed_at":"2026-08-14T12:00:36.831148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.791099Z","title":"John Wiley & Sons","venue":null,"work_id":"43068337-d75b-4c62-a02c-948e3ecf2789","year":1992},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.938188Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:90ac5b75b06c3609a150e9426898c93edcecbeca7c0e8adb844bb7477ca09117","observation_id":"10b45747-fba7-436a-8c29-9ad268c88d3e","resolution":{"observed_at":"2026-08-14T12:00:36.798464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.734332Z","title":"Foundations and Trends in Machine Learning 5(1):1--122","venue":null,"work_id":"0dea954c-c8ce-4ef9-a1fe-d8c3721a5ca2","year":2012},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.945021Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:350b8c3a3d5b158ae88a4ea2029cc28b8434f074702b459a576e29c1171681f8","observation_id":"8881d11a-198b-41fc-8ac3-281a9ecb7254","resolution":{"observed_at":"2026-08-14T12:00:36.756802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.659340Z","title":"In: Proceedings of the third ACM international conference on Web search and data mining, ACM, pp 351--360","venue":null,"work_id":"fbec61ff-d236-45b5-a5a3-88721bde051d","year":2010},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.956158Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:c6bd5214ad6e857494eee2a93ab255f32b53f59d04ed622a7391e93814d69091","observation_id":"8551504c-6531-4ffe-99ef-f0790eb1f15d","resolution":{"observed_at":"2026-08-14T12:00:36.675160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.594900Z","title":"In: Advances in Neural Information Processing Systems, pp 1025--1033","venue":null,"work_id":"03dadb11-87ee-4729-a145-c345441ccf0d","year":2013},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.967207Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:97e3b93eaeb514c0b8a009425ef735d84c693631e305332342860b08a6282e69","observation_id":"28a75f42-17c1-46a2-8889-6ba83caec364","resolution":{"observed_at":"2026-08-14T12:00:36.612314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.551372Z","title":"Marketing Science 28(2):202--223","venue":null,"work_id":"4c8029d8-1438-4abf-9b56-3257e9bafae6","year":2009},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.975360Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:8f551d09fc9e8487c6668359291117463ba5c24f90f0772634b2dfbef7de2458","observation_id":"749006d8-86a2-4a71-ac25-90c1a611cb60","resolution":{"observed_at":"2026-08-14T12:00:36.562898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.502723Z","title":"Journal of artificial intelligence research 4:237--285","venue":null,"work_id":"3c2a5486-7fc2-4bf8-bfac-3908acece70d","year":1996},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.982947Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:fa1708c612fb8febd96e9a3170434b22b9face546c7068caa3bc2cb6ab4d6fe5","observation_id":"35ff7a10-b9c8-4476-86bc-23ab382a0e7b","resolution":{"observed_at":"2026-08-14T12:00:36.522802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.00598","last_updated":"2016-01-12T08:20:21Z","snapshot_observed_at":"2026-08-14T23:01:42.428614Z","submitted_at":"2015-02-02T20:00:13Z","title":"Lock in Feedback in Sequential Experiments","version":3},"cited_work":{"arxiv_id":"1502.00598","doi":null,"metadata_source":"pith","pith_arxiv_id":"1502.00598","snapshot_observed_at":"2026-08-14T12:00:35.546416Z","title":"Lock in Feedback in Sequential Experiments","venue":"cs.LG","work_id":"c51f696c-99be-4467-be78-66d2c3ef3ddf","year":2015},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:34.996205Z"},"links":{"cited_paper":"/paper/1502.00598","citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:8f9928476511015f93fc432c5c02cb49dd465302d805d29fd8150d27943e0804","observation_id":"d776919c-e747-40c4-855d-b642f44527ec","resolution":{"observed_at":"2026-08-14T12:00:35.564928Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.06700","last_updated":"2018-09-04T09:54:07Z","snapshot_observed_at":"2026-08-14T22:09:22.708107Z","submitted_at":"2016-02-22T09:37:24Z","title":"StreamingBandit; Experimenting with Bandit Policies","version":2},"cited_work":{"arxiv_id":"1602.06700","doi":null,"metadata_source":"pith","pith_arxiv_id":"1602.06700","snapshot_observed_at":"2026-08-14T12:00:35.453879Z","title":"StreamingBandit; Experimenting with Bandit Policies","venue":"cs.HC","work_id":"d160a730-ccd3-4e61-82dd-1aa7bc5d14fb","year":2016},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.005829Z"},"links":{"cited_paper":"/paper/1602.06700","citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:c5200f894aaf8bbdc338ea8bedf2c0515d0cf2bf1221ee2fae432a42710d642b","observation_id":"5c925040-f8be-405a-ad03-301d90b41589","resolution":{"observed_at":"2026-08-14T12:00:35.468574Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.428785Z","title":"Palgrave Communications 2","venue":null,"work_id":"d47b0106-a3d3-47af-9bf5-dc990d9c9ea7","year":2016},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.012903Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:dd2017a4b18279e30944d4cdebbdceb56453e71374dea3cf9c6b5d1b4d0c2562","observation_id":"8382c07c-d34e-46f4-8691-7a92f3ee03e3","resolution":{"observed_at":"2026-08-14T12:00:36.452248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.375675Z","title":"In: Advances in Neural Information Processing Systems, vol 17, pp 697--704","venue":null,"work_id":"de9b7dd1-b8fa-4d0d-b7d1-2b8f74797b20","year":2004},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.025223Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:62de0a531554ad1726053e806da6691482b8edff052b7aeaf1857779e956dda4","observation_id":"00ca3d74-4e09-44ec-afb2-b868dd527bba","resolution":{"observed_at":"2026-08-14T12:00:36.388014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.326184Z","title":"In: Advances in Neural Information Processing Systems, pp 2447--2455","venue":null,"work_id":"1cc65c04-5064-474e-9be0-f795995e4f1c","year":2011},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.043761Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:3031c3d3390f2bb65884c15420d7cfd90c5834e6f0e3e4711d9857613a03a298","observation_id":"5aa9f571-6835-46fa-8977-da6ae760ea77","resolution":{"observed_at":"2026-08-14T12:00:36.344730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1402.6028","last_updated":"2014-02-25T01:34:43Z","snapshot_observed_at":"2026-08-14T23:43:30.629323Z","submitted_at":"2014-02-25T01:34:43Z","title":"Algorithms for multi-armed bandit problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1402.6028","snapshot_observed_at":"2026-08-14T12:00:35.065266Z","title":"CoRR abs/1402.6028","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.065266Z"},"links":{"cited_paper":"/paper/1402.6028","citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:42e72f1ca8cd8f2c064f24db545c3e83c0acb30c9b3dab446c052dc4ab0d9eb5","observation_id":"fec22e0e-600f-4b49-8ffd-c940ee03ad37","resolution":{"observed_at":"2026-08-14T12:00:35.065266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.282412Z","title":"Advances in Applied Mathematics 6(1):4--22","venue":null,"work_id":"cac38823-047c-4760-b9ee-b9ca4c27a31d","year":1985},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.075785Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:a7f57983754ac0732b6b5f0fbb8f2c3a43f0121f604e6f58d51b5568e267d64d","observation_id":"89434868-c67b-43a8-b774-78141f22edca","resolution":{"observed_at":"2026-08-14T12:00:36.292894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.210346Z","title":"In: Advances in Neural Information Processing Systems, pp 817--824","venue":null,"work_id":"8647ceb8-f14e-426a-8398-13aa17873b70","year":2008},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.085054Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:08e2c5b51bc7b6113c3504029d0f0277f4e3891ff464dacca56813a560b44ea9","observation_id":"3a857df8-2a72-4e8f-a798-b48175d358ca","resolution":{"observed_at":"2026-08-14T12:00:36.234480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1003.0146","last_updated":"2012-03-01T23:49:42Z","snapshot_observed_at":"2026-08-15T05:25:22.414839Z","submitted_at":"2010-02-28T02:18:59Z","title":"A Contextual-Bandit Approach to Personalized News Article Recommendation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1003.0146","snapshot_observed_at":"2026-08-14T12:00:35.091557Z","title":"In: Proceedings of the 19th international conference on World Wide Web, p 10, 1003.0146","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.091557Z"},"links":{"cited_paper":"/paper/1003.0146","citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:ba0d9739a3934fa42e138bff9062ec10a25222ebb2bc7d9e2cb9fa29b2345fad","observation_id":"4e98384e-8850-4d4a-ac01-f533ac9a1024","resolution":{"observed_at":"2026-08-14T12:00:35.091557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.151293Z","title":"In: Proceedings of the fourth ACM international conference on Web search and data mining, ACM, pp 297--306","venue":null,"work_id":"6adb7d6f-181d-4575-a401-8ce5e670a3f0","year":2011},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.100617Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:fbb5cd4532aadaaad419900ae19bf91ddeb89b85316d36ff835ed227b4916914","observation_id":"da0353ef-b242-467c-91a8-8599670476b8","resolution":{"observed_at":"2026-08-14T12:00:36.171573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.111104Z","title":"In: Proceedings of the National Academy of Sciences, vol 106, pp 22,387--22,392","venue":null,"work_id":"3f7a7cdf-89ba-4f1b-ae72-f630cc3dc81c","year":2009},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.107177Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:2a7133027de6fafea555ee5c580afeb13ad952201efdf4a80c6619d9db267fbb","observation_id":"05c0cf8b-a143-41b3-8a7c-8addbf33107e","resolution":{"observed_at":"2026-08-14T12:00:36.121827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.056231Z","title":"American Journal of Physics 62(2):129","venue":null,"work_id":"5c8e2dec-79ec-41b5-ad05-79e25a33b99c","year":1994},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.117268Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:17de132edddb2c153e063fe10bc8a3ec8975ebb4993405c18e51980497852dfe","observation_id":"cc428034-df84-47bd-b041-20441768407b","resolution":{"observed_at":"2026-08-14T12:00:36.082902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:36.001328Z","title":"Applied Stochastic Models in Business and Industry 26(6):639--658","venue":null,"work_id":"3c7a372e-3b9d-40c3-8bed-ea20cf7e69c3","year":2010},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.126199Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:d5c1033c8e03a199a54439f4fdcea7e8c956d697f1cf2520327dc41b40679129","observation_id":"20051bbe-898e-4bf6-9e59-8223369d905f","resolution":{"observed_at":"2026-08-14T12:00:36.017963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:35.903098Z","title":"MIT press","venue":null,"work_id":"396c5776-cfba-42c2-8788-4e99d0bc80bd","year":1998},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.133785Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:daec6b595d61379240ba604f35e4553d5c31b7db8ec434f2dacd29225be0a0fc","observation_id":"6c2b88c5-1f32-4075-b827-0495b9ddee09","resolution":{"observed_at":"2026-08-14T12:00:35.927099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:35.850307Z","title":"In: AAAI, pp 3000--3006","venue":null,"work_id":"2e842715-9d44-4886-b8b2-d1f213a64fe0","year":2015},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.146931Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:1826d4d0a0acd749591db91044cfc456129ff6e57276d5ae49dec4c9e067be35","observation_id":"cc2a690c-fe2f-4da2-8036-5678508492ae","resolution":{"observed_at":"2026-08-14T12:00:35.866508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:35.817876Z","title":"Biometrika (3-4):285--294","venue":null,"work_id":"72fe8a44-51eb-40fa-9847-b08bfcdfeb56","year":1933},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.159333Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:ee0783a46013c7d002e466b7cee2cdf17925e45ed77f9c622cdce8edd4232480","observation_id":"86904172-0cf6-4f77-a31d-238bdebd3a1a","resolution":{"observed_at":"2026-08-14T12:00:35.826215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:35.778417Z","title":"IEEE Transactions on Automatic Control 50(3):338--355","venue":null,"work_id":"b25b40c2-fe22-449c-b820-32f5983a03e0","year":2005},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.166548Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:b3e028d91fa7fff1f22f7b33b503c632d1fa28fe7dd46d366d3501df0364e28d","observation_id":"130c43c1-e4ed-4a3e-be3a-a5ba36292181","resolution":{"observed_at":"2026-08-14T12:00:35.788134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:35.744150Z","title":"Journal of the Royal Statistical Society Series B Methodological 42(2):143--149","venue":null,"work_id":"0d254d58-7e2c-47da-b2f5-d90814fdbf27","year":1980},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.183394Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:02a38dacde7cae852f230dc4e5aef025599bf9ca74d965d89f64d35a45243d36","observation_id":"1cddb340-86a3-48b2-92f2-97875ce73a11","resolution":{"observed_at":"2026-08-14T12:00:35.753719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:35.678068Z","title":"Computational Statistics & Data Analysis 113:136--153","venue":null,"work_id":"3be0780f-23f0-420d-aa7d-1fab3c78c928","year":2017},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.198538Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:975bc42d1087155267e6a12b06a5e09ed187e77d62065c5f776cacbc58202643","observation_id":"d24ee197-f7a9-4cb2-8ca3-a451e3cb411a","resolution":{"observed_at":"2026-08-14T12:00:35.684728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:00:35.638351Z","title":"Am J Phys 59(6):569--572","venue":null,"work_id":"8a4f53b8-bcec-4c28-9200-c97cc15987f6","year":1991},"citing_paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T12:00:35.239845Z"},"links":{"citing_paper":"/paper/1908.07808"},"observation_digest":"sha256:7d4d240b96d2074c55bbbef53bb2edc2c794f6311dc365e2b053037634ded934","observation_id":"03ab3066-ed16-47fe-90f7-b7d80e83de1b","resolution":{"observed_at":"2026-08-14T12:00:35.652687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.07808","last_updated":"2019-08-21T12:11:03Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T04:40:16.454532Z","submitted_at":"2019-08-21T12:11:03Z","title":"Exploring Offline Policy Evaluation for the Continuous-Armed Bandit Problem"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:1908.07808."}