{"as_of":"2026-08-08T19:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:742fa2ba573e89b0a17c1aa8122ec788c6b51ed147ec1c4390914228768d1b9c","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:51:17.118027Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T02:02:48.665612Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T02:06:15.410216Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"cited_work":{"arxiv_id":"2506.07140","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07140","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1269c04b-42ff-4273-a6fd-c9262a21b7ca","year":2017},"citing_paper":{"arxiv_id":"2605.09257","last_updated":"2026-05-10T01:51:31Z","snapshot_observed_at":"2026-08-02T20:41:00.898458Z","submitted_at":"2026-05-10T01:51:31Z","title":"Regularity, Phase Transitions, and Uniform Inference for Proximal Counterfactual Quantile Processes","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T02:02:48.665612Z"},"links":{"cited_paper":"/paper/2506.07140","citing_paper":"/paper/2605.09257"},"observation_digest":"sha256:b371286797c884a22bb3a4ad481dd856f5621ee3fa1d0c9a29ab27110e012b34","observation_id":"37653c6b-fdfb-4c59-9efa-b6b8e24d0322","resolution":{"observed_at":"2026-05-12T02:06:15.411610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07140/citation-record","integrity":"/paper/2506.07140/integrity","json":"/paper/2506.07140/citation-record.json","paper":"/paper/2506.07140"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:16.740209Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.740209Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:63a124c57a85d8a703dd446b1f93787251e5696868c474c6f9c563e941d50977","observation_id":"e43ef8d8-78c9-4505-aa12-3b365f109743","resolution":{"observed_at":"2026-08-07T05:51:16.740209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.518443Z","title":"write newline","venue":null,"work_id":"57281f2c-1b50-454b-80f9-d26041e31084","year":null},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.746624Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:204a62350dcb67fa920ed4db183b96d4d22f36cc1cd1a0937f8c57a3f5032161","observation_id":"0c655088-b405-41d2-a98e-a72645514d4f","resolution":{"observed_at":"2026-08-07T05:51:18.524389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.491561Z","title":", Angrist, J","venue":null,"work_id":"8b02cc1b-4c87-4211-aa40-91e2aab51eb3","year":2002},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.755622Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:691ff1a3cc34d2afb5d398b37042d407f023bb1b54d5a7ac59b9e9603482a024","observation_id":"fffd8a54-763e-4cce-a690-a032516c9b89","resolution":{"observed_at":"2026-08-07T05:51:18.497368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.471657Z","title":"and Chen, X","venue":null,"work_id":"978a340a-e69e-48dd-9255-57c60db0f4a1","year":2003},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.762672Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:7be01617c39260c2744766c4fc5fa74487229938a368aa6ee38f0e151eb562e5","observation_id":"8869a0cf-c647-46c0-838a-0df477497bd0","resolution":{"observed_at":"2026-08-07T05:51:18.477417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.451900Z","title":"and Chen, X","venue":null,"work_id":"f6c15b34-4fc2-4fef-b37e-26ab16f2af87","year":2012},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.768740Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:33d6edb887b11cd8428fb9a87bdc5514c08a04e551aff94fefd85a4c528795a8","observation_id":"1839a281-0a9c-44df-96bb-eca0c3cb6527","resolution":{"observed_at":"2026-08-07T05:51:18.457828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.430477Z","title":null,"venue":null,"work_id":"cda17919-e5c5-4f09-83fe-ed666ff00d16","year":1996},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.774644Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:1214b4b1d14cecbcf4325d745d69189a26c5cb8054dac6feec12001eff609fca","observation_id":"cab3b94c-54ca-4d57-bab0-8357f6e11aa2","resolution":{"observed_at":"2026-08-07T05:51:18.437199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.408611Z","title":", Cheng, J","venue":null,"work_id":"28b13bc2-b063-49a0-89b7-b12fd8a73ee5","year":2014},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.780007Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:b1f2fc0c3ec96777e2f2a1aaf30708a59da21d572244ef36c4d73e16f23e432f","observation_id":"6db69a2c-5936-429f-9444-c5f983d7b298","resolution":{"observed_at":"2026-08-07T05:51:18.416783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06799","last_updated":"2020-11-29T05:58:30Z","snapshot_observed_at":"2026-07-06T09:55:38.633548Z","submitted_at":"2020-09-15T00:18:34Z","title":"The Importance of Pessimism in Fixed-Dataset Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06799","snapshot_observed_at":"2026-08-07T05:51:16.785857Z","title":", Gelada, C","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.785857Z"},"links":{"cited_paper":"/paper/2009.06799","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:37ea14a79bb2722b50f107d68d42610a93b09ae7c8ab65a4a790627a8646b268","observation_id":"e01cbdfc-7f12-4fc1-af45-611365c03802","resolution":{"observed_at":"2026-08-07T05:51:16.785857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.387703Z","title":", Mannor, S","venue":null,"work_id":"22b2af79-366e-4bb6-978f-e28ee8768cb5","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.792519Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:55eaa692dfabc47c523ea10c8291487cf1395c4642ec23ec9ef4631271e15dbc","observation_id":"f87c0544-051a-444b-8efc-346af51fb5e3","resolution":{"observed_at":"2026-08-07T05:51:18.393771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.369608Z","title":null,"venue":null,"work_id":"bba6b158-b60d-4bfb-b8a1-020527a278f7","year":1992},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.797750Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:acfffd7f102a90c9cb868736ea4c9c3c633e2f22bd5201c741275f4bb37a514b","observation_id":"cb5ccfa0-b6e6-46c9-8c19-d1154cce134b","resolution":{"observed_at":"2026-08-07T05:51:18.374970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11187","last_updated":"2023-03-20T15:17:31Z","snapshot_observed_at":"2026-07-06T15:05:46.003532Z","submitted_at":"2023-03-20T15:17:31Z","title":"A Unified Framework of Policy Learning for Contextual Bandit with Confounding Bias and Missing Observations","version":1},"cited_work":{"arxiv_id":"2303.11187","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.11187","snapshot_observed_at":"2026-08-07T05:51:17.388639Z","title":"A Unified Framework of Policy Learning for Contextual Bandit with Confounding Bias and Missing Observations","venue":"cs.LG","work_id":"990b5795-c7aa-4982-b712-d051926651f9","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.803341Z"},"links":{"cited_paper":"/paper/2303.11187","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:9026c90a97d1ea40e7e08630c74c79c72c133ca07ec945427f87df8b4010398c","observation_id":"7f803d79-cad1-4edd-b9fe-82957dcc1991","resolution":{"observed_at":"2026-08-07T05:51:17.395290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.352441Z","title":", Chernozhukov, V","venue":null,"work_id":"cd148a95-5b9f-4b6c-8b32-83a0887ea440","year":2014},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.808963Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:33e99721dc988aabf86663b4c794edbacead7d403cfb99ed781a0ef5ea0b9561","observation_id":"c9364c13-5c72-44dd-8ab8-81d351f62c1e","resolution":{"observed_at":"2026-08-07T05:51:18.357854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.333351Z","title":", Linton, O","venue":null,"work_id":"8ae195c8-f939-44ca-b0f6-f6f81ed10b8b","year":2003},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.814576Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:24ade14c8ab8136b43d827c029d35daeca86a9c375b483ca140342a5d9fb74e4","observation_id":"366acb26-fb4b-4a09-bbaf-54e43754c498","resolution":{"observed_at":"2026-08-07T05:51:18.339395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.312594Z","title":"and Pouzo, D","venue":null,"work_id":"101b083c-9195-465a-96da-03acf36b76d0","year":2009},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.820283Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:4219bec2203a0fab9af8ff8f5215feff6b975899fe743fbbfc1251678fa0bb5e","observation_id":"ee6575db-12ff-49e8-8947-bb194833b396","resolution":{"observed_at":"2026-08-07T05:51:18.318310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.293551Z","title":"and Pouzo, D","venue":null,"work_id":"3ffc2c69-4234-4cdd-83e5-61c59ac6e8cf","year":2012},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.825416Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:8b36c1262fc1327a20790133aa3779477278c8429ead780efa7687645ea5ce0b","observation_id":"88926071-d22c-411b-854d-970681221b71","resolution":{"observed_at":"2026-08-07T05:51:18.300303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.274080Z","title":"and Pouzo, D","venue":null,"work_id":"b8af8828-fde5-49d8-8bd2-ba3dca1fd5b1","year":2015},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.830976Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:794a79fcca7f6b6d1101339c5c7e3558c5a6b9de6f0c332ed59c7cbb52cbdc89","observation_id":"04ccebed-557a-40ea-a1a6-67053b2cad86","resolution":{"observed_at":"2026-08-07T05:51:18.279914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.256700Z","title":"and Hansen, C","venue":null,"work_id":"e7162b63-5deb-4d6b-ba9c-78afa090abfd","year":2005},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.836761Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:836544130d676727dde53c085c8a50043940f4f04d73937a71690ca2707f4cb9","observation_id":"04f8c4a3-5d5b-463b-b3ca-417a0ac17dfd","resolution":{"observed_at":"2026-08-07T05:51:18.262221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.238792Z","title":"and Hansen, C","venue":null,"work_id":"0ab3bd8b-5cc7-41fe-8915-57ab1d0e99e8","year":2008},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.842100Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:67880103379105db98115fd43e223d173aac95be398f9f9facfdecbbce1998a7","observation_id":"ba8a9208-fb2f-4778-997c-bf41b4541005","resolution":{"observed_at":"2026-08-07T05:51:18.244543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.219632Z","title":null,"venue":null,"work_id":"75cb3c2d-5652-46de-9119-1d2fd27edc7f","year":2017},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.847693Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:13a9f5e8488f637881654ff85361717d7b83e5ecfa1a2094bf97e8873fb544fc","observation_id":"f8d422a6-a91e-45b9-af35-73894ad6f5e2","resolution":{"observed_at":"2026-08-07T05:51:18.225134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.198545Z","title":", Lewis, G","venue":null,"work_id":"6f767013-5131-4597-81fb-7b390b3d1bee","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.854063Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:7f93ff5061b158dcf8ba08a52afb3dea00a88c4166965bfdcfe6f6b760e8e170","observation_id":"9c3076b9-2b3e-4e4c-91a4-a05bb582a5ac","resolution":{"observed_at":"2026-08-07T05:51:18.205455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.180512Z","title":null,"venue":null,"work_id":"2446c573-2207-4cc4-af6a-4e574ac9d677","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.859323Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:3db8d6954989805a6f46279406b62b41047c31639dab78dc32bd9fda8dbde521","observation_id":"1ea87cef-ba75-4daf-a2a1-baa9a2e6f8e9","resolution":{"observed_at":"2026-08-07T05:51:18.186175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.160078Z","title":"and Blake, D","venue":null,"work_id":"6e5febc4-ee87-44cb-87cf-b3869f357f19","year":2006},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.864599Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:f347a85916b09ee9c4347024dc756c0e409be79a8435663be1b62b64d833ff21","observation_id":"73541d60-a410-4729-b476-0962632f61da","resolution":{"observed_at":"2026-08-07T05:51:18.167542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.141223Z","title":null,"venue":null,"work_id":"ba34dccd-99e1-4238-9a8c-6f54d1c63279","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.869625Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:60a7de0a3c246e599fca7e9409fe9ff5324e984e8c1c3a15f141c490e62cd39d","observation_id":"fbb1d2d8-3f4b-4a9b-b20d-ccf06397ccfe","resolution":{"observed_at":"2026-08-07T05:51:18.146763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.122169Z","title":"and Scaillet, O","venue":null,"work_id":"a4d68bae-42de-4e1f-b93d-5f43d1a83049","year":2012},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.875102Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:8d64a3f0554788537999898f4781e80ea8ad1fd520857617e7081d7764d268d6","observation_id":"a99c8a00-c4c7-4961-83ba-c44981b154df","resolution":{"observed_at":"2026-08-07T05:51:18.127915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.104065Z","title":", Lewis, G","venue":null,"work_id":"36310a5f-8c97-4d29-a7d3-f71b8b76fe81","year":2017},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.880386Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:3d8e2d53c6a9b7d29f8a889c128309f8004b3f3ef8ba811c891a156a789162e0","observation_id":"d92d8e66-bcfa-41e9-aedb-405d52d09af2","resolution":{"observed_at":"2026-08-07T05:51:18.109662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.085957Z","title":null,"venue":null,"work_id":"ba42fbeb-0667-4199-989e-09049921a059","year":2016},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.885577Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:e092ffcd833e08bd0e632b57dfd4538db0b212a1c7abd20308cfe2184a6cdafe","observation_id":"7c515e51-1ef4-444b-959a-da983404c304","resolution":{"observed_at":"2026-08-07T05:51:18.091487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.067539Z","title":null,"venue":null,"work_id":"5399a290-9cb6-4b8c-9b70-711e625c4752","year":2007},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.890781Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:8d7305b39a8e1cec11ec185f71928fabbc5bcff0f9304f018bd8c3a2842ccf34","observation_id":"5086773d-8baf-4608-9472-09383957f247","resolution":{"observed_at":"2026-08-07T05:51:18.073210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.06892","last_updated":"2020-02-01T04:58:57Z","snapshot_observed_at":"2026-08-07T06:14:35.067533Z","submitted_at":"2020-01-19T19:58:43Z","title":"Sharp Rate of Convergence for Deep Neural Network Classifiers under the Teacher-Student Setting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.06892","snapshot_observed_at":"2026-08-07T05:51:16.895896Z","title":", Shang, Z","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.895896Z"},"links":{"cited_paper":"/paper/2001.06892","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:2d46c06044b53dfed69f5d08e504ae5e3f36ee5a87be115a003f89555e3e7660","observation_id":"fd8ab0ad-65b4-4e64-b2b5-361db9b093f0","resolution":{"observed_at":"2026-08-07T05:51:16.895896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.049893Z","title":", Yang, Z","venue":null,"work_id":"bf1027cc-7340-47af-8a89-8b5703f859c9","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.901484Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:f415b107666360e367d1255e2548bd7a8586302b8797d7276240c5b7a893f60d","observation_id":"058d10b6-80b6-4195-950e-e45671e9bed3","resolution":{"observed_at":"2026-08-07T05:51:18.055260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14029","last_updated":"2022-10-09T07:31:03Z","snapshot_observed_at":"2026-07-06T10:53:28.085825Z","submitted_at":"2021-03-25T17:59:19Z","title":"Causal Inference Under Unmeasured Confounding With Negative Controls: A Minimax Learning Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14029","snapshot_observed_at":"2026-08-07T05:51:16.906667Z","title":", Mao, X","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.906667Z"},"links":{"cited_paper":"/paper/2103.14029","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:fd9d329858b1b5169c0c18876c109aab5140a5a7c63fc6085f01308dcd5d7c42","observation_id":"7421a8ff-184a-4c54-9447-f0d65dd299c0","resolution":{"observed_at":"2026-08-07T05:51:16.906667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.031836Z","title":", Rajeswaran, A","venue":null,"work_id":"1c6a1f2a-a72b-4be3-b6b8-6b554c85d0fd","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.912761Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:cd9e1a9bd402795b54697702b2ea34b10916551b65febe8a417e48a4d21488b4","observation_id":"2da34668-e462-4271-be47-0fdd4a03f570","resolution":{"observed_at":"2026-08-07T05:51:18.037229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.012211Z","title":", Zhou, A","venue":null,"work_id":"e842a1dd-b675-471f-bc7c-b6a15bedd145","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.917830Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:19ef459c0192cf5c93c9bcd189f0079341de381b2669abe2beef60dcbf81f3d3","observation_id":"ee794ef3-3879-4480-90cb-a63c624f42f3","resolution":{"observed_at":"2026-08-07T05:51:18.018282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.992177Z","title":null,"venue":null,"work_id":"65b9baec-6c8e-4fd1-a1dd-470bcf45f2eb","year":2010},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.923155Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:a52303e0beaad5ee3f5909d4af6b8b1e62087dfe09b63d2f42023936479736d7","observation_id":"24fc6148-6f9c-4fe2-bb43-36d15a18f894","resolution":{"observed_at":"2026-08-07T05:51:17.998704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.973181Z","title":", Jeon, W","venue":null,"work_id":"163ced71-2117-43f7-b929-934e243403ed","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.928244Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:b0f88f21fc36eeaaf80f9f1e639f536e412a79ebbd09ac7a5996c1487fa84462","observation_id":"8ae07b01-6e43-449e-9d3a-966b73059bab","resolution":{"observed_at":"2026-08-07T05:51:17.978766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.955881Z","title":null,"venue":null,"work_id":"e51b5056-0593-43c5-b9a7-edaf7f5020cd","year":2003},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.933536Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d3d11b27d4af9138eff4dd1e68821174d1709af533957d50fecc65462c4f02bd","observation_id":"cc22c84f-1bf6-4b20-9f20-5c562b75fb22","resolution":{"observed_at":"2026-08-07T05:51:17.961198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-07T05:51:16.940185Z","title":", Kumar, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.940185Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:bb4bf8871b6780a4dd590ffbf58551964258ce4d500695c9db6ca10a6850fbe4","observation_id":"3fdf0eea-fb9b-4230-9e24-3420629a2527","resolution":{"observed_at":"2026-08-07T05:51:16.940185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.934758Z","title":null,"venue":null,"work_id":"0c6273ff-d579-4c55-9f74-d85f4c6e2d78","year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.946354Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:a52ab3bcf7391aa5dc02b6f5fc1a75321f580e47238a31d1d8e690d4d0159411","observation_id":"f2d2bbd4-d4de-403d-b00c-68f4a6482941","resolution":{"observed_at":"2026-08-07T05:51:17.942709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.915532Z","title":", Chu, W","venue":null,"work_id":"e04834b7-d2f2-4f68-bc70-0c6d9ff213bf","year":2012},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.951505Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:ab8fa44542625be577d3de06e01a73e3ca4e6e6ae40dfa515b2928ba044a7b23","observation_id":"69037bf8-ce07-4f3b-ab22-6aafa1916248","resolution":{"observed_at":"2026-08-07T05:51:17.921204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.897214Z","title":null,"venue":null,"work_id":"4571b8ec-6301-4c1a-8b1c-96738cdcf365","year":2017},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.956603Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:90fbf3e38b69bf6ac0a3f0c251f62e790418c316352baab18840dfc72dbd6cf8","observation_id":"03546536-f045-414f-9783-6d93b4edb1bb","resolution":{"observed_at":"2026-08-07T05:51:17.902850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.878438Z","title":", Tchetgen, E","venue":null,"work_id":"29f8f1e5-79ed-4f5b-9a8b-da7d805542e2","year":2010},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.961747Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:da8711d9797740c78199ff435d274db3300a9e4e2fb8a5915c78473ee1c8f025","observation_id":"2a8bdf9e-e309-4f43-963e-92864b686a28","resolution":{"observed_at":"2026-08-07T05:51:17.884036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.860823Z","title":", Ding, L","venue":null,"work_id":"c3eb5bac-aaa7-4764-b497-2f3b004117fd","year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.966667Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:e1e3a4890dc8bee8d9d24e3014699bc07718f2eea04a9f342510c43bbef79e37","observation_id":"28d7138a-476a-4384-873e-6addef48ad0e","resolution":{"observed_at":"2026-08-07T05:51:17.866293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.841623Z","title":", Chen, Z","venue":null,"work_id":"245848f2-f8d5-4f7f-8321-f356c624ad5e","year":2024},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.971939Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:944e36db8c4101d59f74d07b97f991204aceabb40be993d374e018b9e4002f77","observation_id":"2da4b452-5a18-4915-b71f-8bcb2f73c6b3","resolution":{"observed_at":"2026-08-07T05:51:17.847818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13589","last_updated":"2024-04-01T04:49:15Z","snapshot_observed_at":"2026-07-06T13:14:26.331614Z","submitted_at":"2022-05-26T19:13:55Z","title":"Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes","version":3},"cited_work":{"arxiv_id":"2205.13589","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.13589","snapshot_observed_at":"2026-08-07T05:51:17.302596Z","title":"Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes","venue":"cs.LG","work_id":"6df38efd-b98f-4e96-bbd7-5932b0a08863","year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.976996Z"},"links":{"cited_paper":"/paper/2205.13589","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d55bba766218abced4867282bb8a3f86986dc2ddb7e513cf7404fe59097e70e8","observation_id":"b328ad02-32ce-4bd7-9c48-2608fc63ea58","resolution":{"observed_at":"2026-08-07T05:51:17.309010Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.818418Z","title":", Giguere, S","venue":null,"work_id":"0e8af91b-6a34-4a8f-afea-86dd99b376d7","year":2019},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.982280Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:4ee733937e4894822c52a4c631ceeada6fd92c32aa7c44ad26dff9d5148b6d84","observation_id":"d3af1a60-e1b2-45d5-a3c7-86b6bbd3c750","resolution":{"observed_at":"2026-08-07T05:51:17.825411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12670","last_updated":"2023-02-24T14:50:47Z","snapshot_observed_at":"2026-08-07T06:06:44.151920Z","submitted_at":"2023-02-24T14:50:47Z","title":"Personalized Pricing with Invalid Instrumental Variables: Identification, Estimation, and Policy Learning","version":1},"cited_work":{"arxiv_id":"2302.12670","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.12670","snapshot_observed_at":"2026-08-07T05:51:17.275462Z","title":"Personalized Pricing with Invalid Instrumental Variables: Identification, Estimation, and Policy Learning","venue":"stat.ME","work_id":"fa33cc3c-aa4c-4cc7-9a5d-8be50aa3b9a5","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.987229Z"},"links":{"cited_paper":"/paper/2302.12670","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:e2a63f4357153f571395da87cd2734da1a626211262d630621777539b4851048","observation_id":"c38bc1ff-9686-4a63-8025-a748a21bf3d3","resolution":{"observed_at":"2026-08-07T05:51:17.282072Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.797419Z","title":", Geng, Z","venue":null,"work_id":"76a9127f-8cbf-413b-8595-a112ed6ef279","year":2018},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.992428Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:a4c0b14c501db933ac2599c288bb03ce9dd4111dd6829dc97531bcfb26add1f8","observation_id":"74137254-38aa-4334-91b1-411203cc2088","resolution":{"observed_at":"2026-08-07T05:51:17.803865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.775482Z","title":null,"venue":null,"work_id":"dc1a4f39-ca47-4894-8557-0aca26c3f520","year":2003},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.997139Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:db22cc9ed1460f2fd75bde97aee92ef7b3eb161c8b3e2fc0755d08101e7657c2","observation_id":"02a46e5d-0a6e-4ebd-aaa5-ab624ba9e57c","resolution":{"observed_at":"2026-08-07T05:51:17.781889Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.756405Z","title":null,"venue":null,"work_id":"046b5b76-758e-4f34-a121-e081a09569e8","year":1995},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.002334Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d1811883af5b8756140c9b4c94e46b7bc2a7a6932929e2452ed9ea83f9f0afc7","observation_id":"9ff314fa-6074-4e63-80b4-4f0d55bd79c9","resolution":{"observed_at":"2026-08-07T05:51:17.761931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.737018Z","title":", Jagannathan, K","venue":null,"work_id":"1f7a6340-c1dc-4eba-aca1-8f3fe15a0b07","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.008135Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:971ab80546c624671951f699c03c6b7ccc1a85b343a4e46274c6ce5be36436a7","observation_id":"76758fb6-eddf-4bee-aac8-5d171933d4b0","resolution":{"observed_at":"2026-08-07T05:51:17.742655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.715455Z","title":null,"venue":null,"work_id":"c88b3af5-0880-4228-b086-7cb12e4770a7","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.013078Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:1d921b7510bd9d72e71fd61a52f0a3636b614fe2d75e6014e42d8ce527c5a109","observation_id":"d2ce39d1-40c2-4fd9-b839-4e5107989ace","resolution":{"observed_at":"2026-08-07T05:51:17.723023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.695589Z","title":", Zhu, B","venue":null,"work_id":"85121887-ff7f-4671-a272-9d4f5a4a7fe0","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.018375Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:594d0c174b5c04195d8ef222a51c553f893e228f7c67339ade1b6e2a7d95fa39","observation_id":"814bafd3-eb96-4692-aedd-209d686bd653","resolution":{"observed_at":"2026-08-07T05:51:17.701676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00716","last_updated":"2022-11-01T19:28:48Z","snapshot_observed_at":"2026-07-06T14:13:15.252546Z","submitted_at":"2022-11-01T19:28:48Z","title":"Optimal Conservative Offline RL with General Function Approximation via Augmented Lagrangian","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00716","snapshot_observed_at":"2026-08-07T05:51:17.024238Z","title":", Zhu, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.024238Z"},"links":{"cited_paper":"/paper/2211.00716","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:5a15f54bef0b79ee3acddf8e14f9a4620a3aa5d6ba9b0b61f9de2bb1483139bd","observation_id":"cf44ae55-dfab-4780-9bb2-ca7787dda7d9","resolution":{"observed_at":"2026-08-07T05:51:17.024238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.673701Z","title":null,"venue":null,"work_id":"fd51e628-19b5-4dea-8159-8090c462e2a2","year":1983},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.029947Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:69eeaf8d4314dfa546792ff55a95a0996de4a575ed47f235618e23ccca6036c9","observation_id":"34de41d3-5753-4c82-9289-212b7faf0f4b","resolution":{"observed_at":"2026-08-07T05:51:17.680247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.651925Z","title":null,"venue":null,"work_id":"60d4cb30-0a6e-4ce6-bbbd-816beaab0d1b","year":1974},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.035151Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:2639f7e9b080a63f9064400f00c82de8c7f451d6a0cb443200b7db8bc8492344","observation_id":"d367a164-7463-40d2-8bc2-17bd5b1570e8","resolution":{"observed_at":"2026-08-07T05:51:17.659753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10982","last_updated":"2020-09-23T07:46:53Z","snapshot_observed_at":"2026-08-06T05:37:57.951987Z","submitted_at":"2020-09-23T07:46:53Z","title":"An Introduction to Proximal Causal Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10982","snapshot_observed_at":"2026-08-07T05:51:17.040316Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.040316Z"},"links":{"cited_paper":"/paper/2009.10982","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d4e4ff973f9fbbef5294975fdf75beab6a253c7a37d5307ea3c5eea97b1e7bb1","observation_id":"70ec07fa-16df-4bd1-adff-b0fedb3f863b","resolution":{"observed_at":"2026-08-07T05:51:17.040316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.02981","last_updated":"2022-07-24T23:49:47Z","snapshot_observed_at":"2026-07-06T10:38:42.987304Z","submitted_at":"2021-02-05T03:20:39Z","title":"Finite Sample Analysis of Minimax Offline Reinforcement Learning: Completeness, Fast Rates and First-Order Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.02981","snapshot_observed_at":"2026-08-07T05:51:17.046132Z","title":", Imaizumi, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.046132Z"},"links":{"cited_paper":"/paper/2102.02981","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:ed31fd438eb186bf1ae19c531283a6e24f81e2533837de06f0deaf3c050a3568","observation_id":"c2a4d6b5-cc7d-4173-b27f-2db3205d3a47","resolution":{"observed_at":"2026-08-07T05:51:17.046132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.631855Z","title":null,"venue":null,"work_id":"42fe97eb-0463-4b58-a7c0-cff061a54ce4","year":2009},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.052253Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:9b9ab69e1379ca7e1477ab66fc24456449e5fb42d6229f27abc02855b0f2be26","observation_id":"d5e856ad-dc17-46bd-b303-084496c712e6","resolution":{"observed_at":"2026-08-07T05:51:17.637846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.609612Z","title":"and Wellner, J","venue":null,"work_id":"2c3d37ae-85bf-4069-924f-bbdcc1b88bfe","year":2013},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.057373Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:1b627d1d29a2bec467cedcaf7a0cc02a46cb614e32bbcc7f62f79cfdd41f6b90","observation_id":"7e33f4d8-53ec-42d1-9c00-240ef3826f37","resolution":{"observed_at":"2026-08-07T05:51:17.616811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.589379Z","title":null,"venue":null,"work_id":"3d919442-7608-4571-986b-4a09438a4334","year":2000},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.062538Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:88b3648fb5c7d08eacb049dcd4c32c82a7c0a3682b795128acd30fe6215f50cc","observation_id":"b0657abe-73b3-46e3-bd31-0364d8f81738","resolution":{"observed_at":"2026-08-07T05:51:17.595628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.568520Z","title":null,"venue":null,"work_id":"a1e8cbfd-1210-4e4f-bcd3-a824eb67135f","year":2019},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.067732Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:b6236ee97e0853cd26c54fc1c67be906d3fe72d43ff1c66ec5f00c9348b60bdd","observation_id":"e3613471-1d66-4a13-b36d-7085cb99d19d","resolution":{"observed_at":"2026-08-07T05:51:17.574740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.549696Z","title":", Yang, Z","venue":null,"work_id":"21110f5c-1e08-4641-9516-28565cb584b6","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.072919Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:a7fd130539444781c871328065cbc51359da927cf30f4668deb0f6c075fc1c97","observation_id":"c9c8390d-2a99-4bed-8e59-403486d9dbb6","resolution":{"observed_at":"2026-08-07T05:51:17.555534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.526407Z","title":null,"venue":null,"work_id":"028a22ba-fc01-483f-a980-db1981d1989c","year":2018},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.077912Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:279b0078bafe57a394d0cfae4b1728dd787eea03d2b4e07e3d201472926256c6","observation_id":"6070efcd-79f5-4eff-94e5-6bf44d6f0588","resolution":{"observed_at":"2026-08-07T05:51:17.533492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.502913Z","title":null,"venue":null,"work_id":"270f4a5b-5405-48b6-b887-117b5b88a9e1","year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.083315Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:4535fc685c603d08c876d9daf64232e99b040cb14e6354ff5ca6f223df94edea","observation_id":"8372cff0-b2f5-4736-8a60-4964e0af34c3","resolution":{"observed_at":"2026-08-07T05:51:17.508326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.484743Z","title":null,"venue":null,"work_id":"eb626576-8656-4543-a0a6-757022475d0d","year":2010},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.088394Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:7f821f69d83aa360d005f0f8f854738657b681887a5d550c3cd5633a3762f9e7","observation_id":"669b6dc0-8234-404c-a32a-0d1033a79fd2","resolution":{"observed_at":"2026-08-07T05:51:17.490296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.467429Z","title":", Cheng, C.-A","venue":null,"work_id":"2eca9a1b-d271-477a-9c96-90b618e9ce3a","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.093450Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:17730232953b5c6c0ac466ac6bf5f79906652565bb382fae193ac9adcd0e0872","observation_id":"a22ab56f-9e72-4b03-85a5-621fad4037cc","resolution":{"observed_at":"2026-08-07T05:51:17.472646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.08646","last_updated":"2019-07-19T18:52:35Z","snapshot_observed_at":"2026-08-05T04:13:07.982936Z","submitted_at":"2019-07-19T18:52:35Z","title":"Fair quantile regression","version":1},"cited_work":{"arxiv_id":"1907.08646","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.08646","snapshot_observed_at":"2026-08-07T05:51:17.182730Z","title":"Fair quantile regression","venue":"math.ST","work_id":"fbcd7d21-882b-4f5c-8c1a-9a4effd2bfec","year":2019},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.099106Z"},"links":{"cited_paper":"/paper/1907.08646","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:a540a9d493ab634fee822482f4614152ee6e7bdeea919c44ba3380f66ec9782a","observation_id":"dd2ac210-710e-4917-9727-a439012c6f20","resolution":{"observed_at":"2026-08-07T05:51:17.189931Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.05804","last_updated":"2022-03-11T09:00:12Z","snapshot_observed_at":"2026-07-06T12:46:41.057346Z","submitted_at":"2022-03-11T09:00:12Z","title":"Near-optimal Offline Reinforcement Learning with Linear Representation: Leveraging Variance Information with Pessimism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05804","snapshot_observed_at":"2026-08-07T05:51:17.105267Z","title":", Duan, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.105267Z"},"links":{"cited_paper":"/paper/2203.05804","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:c3feac999e8ada607b29ac975e7e48d0bbd55e3a37b67562bc80714d28403344","observation_id":"f8fd36ff-4ce6-4f2f-bf7d-a6798274c259","resolution":{"observed_at":"2026-08-07T05:51:17.105267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.448357Z","title":", Thomas, G","venue":null,"work_id":"dca73904-e6f8-4be6-82ee-e061d1e59ee1","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.111707Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:1f838f37519622c055dc1d980e7924b3e34fe584e1bdc1f59fd7ecf86d92632a","observation_id":"aa4654b4-3f15-4e4b-9c7f-4384b58a9e0c","resolution":{"observed_at":"2026-08-07T05:51:17.454424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.429589Z","title":"and Tan, V","venue":null,"work_id":"5b666a5b-3a83-4341-b882-d87339da6d57","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.118027Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:ed4d68a65214fde9df0bcdf6750139509151d772c0f1213adc7d3ab5554df50a","observation_id":"bd873078-17e5-4815-bd59-1cd13b5a66dd","resolution":{"observed_at":"2026-08-07T05:51:17.435076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-07T05:38:55.820011Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":4,"verified_fuzzy":34},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 1 inbound Pith citation observation for arXiv:2506.07140."}