{"as_of":"2026-08-24T03:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:16a8dbb0dea0eceddb6b9e7f9a555f813f26275fc15b53b74964d65e0e0fb759","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:23:34.075814Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16236/citation-record","integrity":"/paper/2507.16236/integrity","json":"/paper/2507.16236/citation-record.json","paper":"/paper/2507.16236"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:39.595403Z","title":"Flambe: Structural complexity and representation learning of low rank mdps","venue":null,"work_id":"7562b070-1248-4d99-9c35-976044610275","year":2020},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:29.510734Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:e42449ca80ab9681c27ec2b95162402b7a2c93413a0b5070dcb800333022297b","observation_id":"129f7a67-b9f3-4837-b44c-3e087b8b57b5","resolution":{"observed_at":"2026-08-06T15:23:39.716930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11824","last_updated":"2026-03-06T03:35:34Z","snapshot_observed_at":"2026-08-18T12:34:49.117247Z","submitted_at":"2024-11-18T18:44:00Z","title":"Theoretical Foundations of Conformal Prediction","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11824","snapshot_observed_at":"2026-08-06T15:23:29.628586Z","title":"Angelopoulos, Rina Foygel Barber, and Stephen Bates","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:29.628586Z"},"links":{"cited_paper":"/paper/2411.11824","citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:66cd72aba86b1e590f35fbf183115780c98e8d2f3fbe0743b296be0361fcce3a","observation_id":"ecd27e14-06e8-4dee-b111-f20ae6d3c826","resolution":{"observed_at":"2026-08-06T15:23:29.628586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:39.308156Z","title":"Conformal Prediction for Reliable Machine Learning: Theory, Adaptations and Applications","venue":null,"work_id":"2246ea70-bcfe-458a-837f-266ad7606b7b","year":2014},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:29.791999Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:db6f5e16e00ed81377f02e6e509fff8dae87dcf55751cd41a3953104e7242e2c","observation_id":"f8689378-45d1-4dce-9a2e-92398eddcee8","resolution":{"observed_at":"2026-08-06T15:23:39.435117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:29.883172Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:29.883172Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:c06e05a49160f94fc13679b9a4a26a18d3880c1b5e65e0b771fe7bbc4ebfdaad","observation_id":"2fdffcaf-f32b-4270-81a2-2ceb1abdc3e0","resolution":{"observed_at":"2026-08-06T15:23:29.883172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:39.155151Z","title":"Coindice: Off-policy confidence interval estimation","venue":null,"work_id":"3ce167dc-1274-436a-97e9-063420058bcc","year":2020},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:29.960400Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:d3b118b4b2f4e35974a51b12a67fc91d24d54b7a1cc832535777066b25330d1c","observation_id":"bca19644-45aa-4878-909a-8f5600a868c3","resolution":{"observed_at":"2026-08-06T15:23:39.217001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:30.104414Z","title":"Doubly robust policy evaluation and learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.104414Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:1f4c3d009c43313772b16bdcee9e14873fb2ce2886137710361fc333b5aaa10e","observation_id":"cbf3f620-2a62-4373-8f4a-27bace362506","resolution":{"observed_at":"2026-08-06T15:23:30.104414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:38.920329Z","title":"Probability: Theory and Examples","venue":null,"work_id":"0b447a61-25ea-4efe-8202-c26221bfdd1f","year":2019},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.235026Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:6e361361eb6cb5aa3b19577671e16475a093998562b511777e333f8e691bb714","observation_id":"836f8c8a-6a05-4c1d-98e0-256bc52b20d0","resolution":{"observed_at":"2026-08-06T15:23:39.066746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:38.784284Z","title":"Accountable off-policy evaluation with kernel B ellman statistics","venue":null,"work_id":"0edecce0-6711-4276-bbcb-ae318e36ac20","year":2020},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.296061Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:07a2d539782ef5a3f7b42c571ce2642a73ace69ea1f839f334ba0877f041c21b","observation_id":"3fc296c5-ebc0-408a-8677-8f8bfb87e10e","resolution":{"observed_at":"2026-08-06T15:23:38.821342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:30.380597Z","title":"Conformal off-policy evaluation in markov decision processes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.380597Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:86ffcae9f69e45d24cd1bee3784138492222c18e16be7d41ed7c5113757ef666","observation_id":"acec90cd-81b4-4cbd-a603-bca229515bdf","resolution":{"observed_at":"2026-08-06T15:23:30.380597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:30.507896Z","title":"The limits of distribution-free conditional predictive inference","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.507896Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:9cd6c490e4cecfeaca5e22c2518a9fda07a1d820a96b784e3d55b30295631883","observation_id":"16682126-b679-4303-b833-74f9e43ead67","resolution":{"observed_at":"2026-08-06T15:23:30.507896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v31i1.11123","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Bootstrapping with models: Confidence intervals for off-policy evaluation","venue":null,"work_id":"8b4e1d47-9d64-4171-920d-f9ca8ea63e66","year":2017},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.639630Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:7b512d350da04de0abaab7d94896538b4cbe274b9109382ad8e9fc3dc97c3b20","observation_id":"1d261fd5-749e-42ee-825b-ea886bbfac53","resolution":{"observed_at":"2026-08-06T15:23:34.780042Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:30.694343Z","title":"Off-policy risk assessment in contextual bandits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.694343Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:8dce259491a8657673016849aa80caf182479ac2f163cd08ede52a7e64d4c835","observation_id":"95685ec5-c050-434e-bef2-fb1b25fc6a48","resolution":{"observed_at":"2026-08-06T15:23:30.694343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:38.558104Z","title":"Doubly robust off-policy value evaluation for reinforcement learning","venue":null,"work_id":"c68429c1-0287-4caf-9dae-63b138596615","year":2016},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.816766Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:232510c47f0e4faeb090884471de2ce46cc3f01dd0d5bf1aa0f45e86180ba79c","observation_id":"920e756c-7505-457c-ada6-5b0c8ecf09d0","resolution":{"observed_at":"2026-08-06T15:23:38.655476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:38.392733Z","title":"Double reinforcement learning for efficient off-policy evaluation in markov decision processes","venue":null,"work_id":"bf53c1b7-9c0b-401c-a673-ce704c4b1c77","year":2020},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:30.937521Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:b92684e6b8b1f81b369352f9ff1717b85024751551b2f2388aa907dcae937528","observation_id":"b45788ad-92ae-45bd-83c1-c5e9bf53b8a4","resolution":{"observed_at":"2026-08-06T15:23:38.446958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:31.018339Z","title":"Being optimistic to be conservative: Quickly learning a cvar policy","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.018339Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:8a58cb2d96692d7843c33c60da13c10567a384cd8b602df374dd15fcfe8e78e9","observation_id":"aa6ff4c6-e87c-430f-a103-ce4985695368","resolution":{"observed_at":"2026-08-06T15:23:31.018339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:38.150816Z","title":"Regression quantiles","venue":null,"work_id":"bc6b5f56-4b79-4ac0-b04e-5a038798a759","year":1978},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.105568Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:dea22138b8a0b18b61d385c081a62e01ed589575653e4cbdb7c9f4f4923521cd","observation_id":"a2b66b48-84de-4071-9a92-66d280857bdf","resolution":{"observed_at":"2026-08-06T15:23:38.284734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:37.906023Z","title":"Batch policy learning under constraints","venue":null,"work_id":"236be967-79f2-444c-ad8d-260555f7004b","year":2019},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.171857Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:1e2c30ff4b1c8d339ce7df760a31ebcd20317239b928ce10ac5b93eef662397b","observation_id":"62975c2d-94fe-41f7-9d3c-3131ff5261d9","resolution":{"observed_at":"2026-08-06T15:23:38.031473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:31.232917Z","title":"Tibshirani, and Larry Wasserman and","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.232917Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:349c5ec38ad975a385ef52eb52e01eb524c11af545c16e62d10852a2aa8a66dc","observation_id":"5f536453-cd41-490c-a626-fc4658b59dbe","resolution":{"observed_at":"2026-08-06T15:23:31.232917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:31.296033Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.296033Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:fd5c90e017c2b2ae6d7b37b0763f6cc6af455551217ccb9754d7755a776064dd","observation_id":"3297172b-15d3-4174-a830-17b5ad92417b","resolution":{"observed_at":"2026-08-06T15:23:31.296033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:37.692035Z","title":"Breaking the curse of horizon: Infinite-horizon off-policy estimation","venue":null,"work_id":"d0a3470e-3b6e-4f7d-8152-c8e44af7dbb8","year":2018},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.397815Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:6af9a1b52c128396e41f119429e9953b6f1817ea525ad69ffda3059b94c0a053","observation_id":"50af4c17-61fe-4017-964d-76aec1ecbab4","resolution":{"observed_at":"2026-08-06T15:23:37.795651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:37.470200Z","title":"Quantile regression forests","venue":null,"work_id":"628b1054-0757-4644-98a7-70773a89490b","year":2006},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.506299Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:f46323dfb8731a1c2e632513464c2de77e914da533a232c6388efed7b8bd39f8","observation_id":"645a994f-34ad-4056-8116-96d03dfeb446","resolution":{"observed_at":"2026-08-06T15:23:37.559402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:37.239436Z","title":null,"venue":null,"work_id":"93713754-8451-4fc4-8a5d-8d5b347f5bc7","year":2013},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.583444Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:a2cf3bbb80d77ab771d93f76fe7b2cb342b143eecdde0f9cdedb9479e4cbb641","observation_id":"24693755-696c-463f-8f29-d3778b869240","resolution":{"observed_at":"2026-08-06T15:23:37.368665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:37.080474Z","title":"Pac confidence sets for deep neural networks via calibrated prediction","venue":null,"work_id":"ef564057-9ed0-4dc5-a8df-f8587218bffe","year":2020},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.729776Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:367e720a6d17fa4a48d40a92aa3ed0bf4bfa9ee463df06d7a245131637158f24","observation_id":"a9cea870-edbe-4371-b9c8-7575bb7966ae","resolution":{"observed_at":"2026-08-06T15:23:37.143075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:36.902688Z","title":"PAC prediction sets under covariate shift","venue":null,"work_id":"008c7fe9-c9eb-4417-8238-98756887b486","year":2022},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.820111Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:f59f2cd0cc2b002b8dd6fd390fdcd7019ef1bad3a1c78774d3251ba4671d1f06","observation_id":"e93d2bf3-dd2c-4172-87ec-adfa8eea0645","resolution":{"observed_at":"2026-08-06T15:23:36.995514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:31.941020Z","title":"Eligibility traces for off-policy policy evaluation","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:31.941020Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:f9308def553fe1921b3fa20c9e195d6f7b96b7c854799bb975b689e94f1ab6bd","observation_id":"3de7efb5-3390-4008-8eb3-a37c7bd3f571","resolution":{"observed_at":"2026-08-06T15:23:31.941020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:36.641982Z","title":"Conformalized quantile regression","venue":null,"work_id":"c3010166-aae9-431d-ad84-c110ed0b3e99","year":2019},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:32.047342Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:da9610af0398f9050708b925bc40b5843c51daf587f1a1cd8574f224c31220c7","observation_id":"9e36572c-fc54-4ffb-9c2b-b76132021b67","resolution":{"observed_at":"2026-08-06T15:23:36.734026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:36.385178Z","title":"Importance resampling for off-policy prediction","venue":null,"work_id":"44678c34-974e-41c2-a9d4-eb6afb587046","year":2019},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:32.112694Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:832fb6d0ad52079bb01bc4302bb25acc960d7e1df3be10677f393a813807595c","observation_id":"c9e7bc18-15e1-4a5c-89f0-55b068e92d65","resolution":{"observed_at":"2026-08-06T15:23:36.494298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:32.219549Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:32.219549Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:745563e1923d5a44d96b6e88b551540326742c23d192b833c007b985de4671ca","observation_id":"701d4899-3c8a-42fc-a76a-076fadc2616b","resolution":{"observed_at":"2026-08-06T15:23:32.219549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:36.233912Z","title":"A tutorial on conformal prediction","venue":null,"work_id":"35f9b921-8536-48fb-b00e-efe0785819a1","year":2008},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:32.389365Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:8c9afcac7c477218ae57ec0cd61e2a255e2f567d45203aa6e1cea86e8e3187f2","observation_id":"99a77061-efbb-42dd-bb0b-23ae12a00594","resolution":{"observed_at":"2026-08-06T15:23:36.304829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/rssb.12465","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Statistical inference of the value function for reinforcement learning in infinite-horizon settings","venue":"Journal of the Royal Statistical Society Series B (Statistical Methodology)","work_id":"bc187414-b985-4640-8c96-86e68227cb22","year":2021},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:32.490149Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:ed3011d90577eadb87f5bd8175e6022ccf3db03b8481231dca545d0b3c423f4c","observation_id":"f894fe91-6d42-4b06-957a-3c698511f66f","resolution":{"observed_at":"2026-08-06T15:23:34.545590Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:32.663533Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:32.663533Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:d4d266913f88890a3bcfe8e450988006895d543d7d2debd7008fbbb0ba3623a0","observation_id":"e92fd342-60f5-4806-8d60-ce12ac3261db","resolution":{"observed_at":"2026-08-06T15:23:32.663533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:36.001428Z","title":"Conformal off-policy prediction in contextual bandits","venue":null,"work_id":"3c334e00-c647-492c-b3c0-94c52723efdb","year":2022},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:32.820565Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:b22d6d09dca95a6280c1b5093ddb9116d50b2270d28a31f7bb0ed8576a75cbba","observation_id":"8d74a72f-6bfa-4b16-b33d-a39d20d9032e","resolution":{"observed_at":"2026-08-06T15:23:36.102577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/1099-131x(200007)19:4","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:34.262370Z","title":null,"venue":null,"work_id":"3b2b6205-5ccf-4b86-8b8e-48db89dae60a","year":2000},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:32.948435Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:e0e5779be8fd7763c7fc8b0f0befdf38b801e5e5faa8b021d63df60656d73388","observation_id":"46f11c72-7bbb-4313-a591-54ea7fbcf24c","resolution":{"observed_at":"2026-08-06T15:23:34.325277Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:35.736453Z","title":"Data-efficient off-policy policy evaluation for reinforcement learning","venue":null,"work_id":"eb57aec1-647e-4cf8-91a6-83faa6e348a0","year":2016},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:33.060790Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:646fed549c688a47a71b75bc2c88aebfb44c481c3997cdd8eb447b55b40b6f14","observation_id":"865d7ec2-debc-4a51-9135-fd381bba04a7","resolution":{"observed_at":"2026-08-06T15:23:35.893582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:33.196451Z","title":"High-confidence off-policy evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:33.196451Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:28035ecda5710a6d23851dbe317ad2108cf8043bdf9487569a0dd5995d680d37","observation_id":"e2ba4b02-f3c1-4571-bb75-503805328a30","resolution":{"observed_at":"2026-08-06T15:23:33.196451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:35.532155Z","title":"Conformal prediction under covariate shift","venue":null,"work_id":"a1016f69-28fc-4a04-8719-9743a10b872e","year":2019},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:33.344810Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:7cb8d4c7c8d115a655a8f40734dbcbf7dc6e820e49e6feddc153b00e1c1fcd28","observation_id":"9f7e619f-2122-405f-985c-f65902ef7c0b","resolution":{"observed_at":"2026-08-06T15:23:35.622962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06355","last_updated":"2022-12-13T03:38:57Z","snapshot_observed_at":"2026-08-16T16:09:06.835048Z","submitted_at":"2022-12-13T03:38:57Z","title":"A Review of Off-Policy Evaluation in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06355","snapshot_observed_at":"2026-08-06T15:23:33.504561Z","title":"A review of off-policy evaluation in reinforcement learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:33.504561Z"},"links":{"cited_paper":"/paper/2212.06355","citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:2a0054f492d01adc6f78ab6e7be9a8d71d91af7838d12b6a7f373c1fe244cae7","observation_id":"3bf10217-2875-4625-a158-f035ca1bd6db","resolution":{"observed_at":"2026-08-06T15:23:33.504561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:35.313669Z","title":"Various techniques used in connection with random digits","venue":null,"work_id":"af957318-980a-4959-ac82-0a5303788f63","year":1951},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:33.614403Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:02a8f34dedb7ac3f6f5fb939d4ad941cbc976de4a4eda6749b7baa69d7a38529","observation_id":"cb7e2ab8-9203-4148-871c-0364cb4f62f6","resolution":{"observed_at":"2026-08-06T15:23:35.405314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:33.771685Z","title":"Conditional validity of inductive conformal predictors","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:33.771685Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:ec2c2be1cff224513f1572204d0e54b2f305662fa026dcd8cad1ec4dde7bb6ef","observation_id":"ed03ebd2-6c31-450b-9e90-a0decce91f89","resolution":{"observed_at":"2026-08-06T15:23:33.771685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:33.897896Z","title":"Algorithmic Learning in a Random World","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:33.897896Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:f45179cc27417e81666c0d58ee114ac87a3d931068be7b41a3c8bd07aa4e89ae","observation_id":"eda54b20-0222-4371-8674-0ffc8dbe5505","resolution":{"observed_at":"2026-08-06T15:23:33.897896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:23:35.063684Z","title":"Conformal off-policy prediction","venue":null,"work_id":"724b1c6e-f3fd-4ea2-8876-8bc75b8f7860","year":2023},"citing_paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T15:23:34.075814Z"},"links":{"citing_paper":"/paper/2507.16236"},"observation_digest":"sha256:0db741663d88cec560a7a5dd3e66399aba76cbc03874e46b80a1906132c24f77","observation_id":"6f7645ee-717d-4e8f-931a-23635fb75325","resolution":{"observed_at":"2026-08-06T15:23:35.150810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16236","last_updated":"2025-07-22T05:12:29Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-16T17:32:02.183824Z","submitted_at":"2025-07-22T05:12:29Z","title":"PAC Off-Policy Prediction of Contextual Bandits"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":3,"verified_fuzzy":21},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2507.16236."}