{"as_of":"2026-08-08T11:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2da17dc47c9f9ec9d0c26d9dd886aca4153b2fc8bc64996645c65c06c5f78994","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T22:19:16.414341Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23432/citation-record","integrity":"/paper/2607.23432/integrity","json":"/paper/2607.23432/citation-record.json","paper":"/paper/2607.23432"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.385728Z","title":"Bridging the gap between regret minimization and best arm identification, with application to a/b tests","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.385728Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:14d15284ffb831a67f61bc5ba8c868d13f6541e43394ad7222dbc53e7d8c8ef3","observation_id":"1f27d64e-d5bb-4789-b875-b4f904d23209","resolution":{"observed_at":"2026-07-30T22:19:16.385728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.410080Z","title":"Therefore, we find that whenN < K1/3(T−N) 2/3, the instance-independent lower bound is Ω q K·(T−N) 2 N","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.410080Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:55a240fca4d54be76cb52c3ae230c9d28ba85c7f5c68216cd8ac64fc6e23e055","observation_id":"2999f7de-0df2-41a0-b9e1-664076d746d4","resolution":{"observed_at":"2026-07-30T22:19:16.410080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.414341Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.414341Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:4f400cc5e76cb0f13a61d0b1620585a142bf26ddffc9f8196d4a226027bd1a58","observation_id":"7a4fe39a-f5b2-412d-9c03-631be5ad27c4","resolution":{"observed_at":"2026-07-30T22:19:16.414341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.374738Z","title":"doi: 10.1023/A: 1013689704352","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.374738Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:8ba45aa61aa8550dca497f6654a516a690048852f90ae027b58b3d5e6c760ce2","observation_id":"2573b3dc-1503-4e0d-8f2f-8b3718c81650","resolution":{"observed_at":"2026-07-30T22:19:16.374738Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07079","last_updated":"2022-02-14T22:58:13Z","snapshot_observed_at":"2026-07-06T12:37:46.989132Z","submitted_at":"2022-02-14T22:58:13Z","title":"Synthetically Controlled Bandits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07079","snapshot_observed_at":"2026-07-30T22:19:16.389455Z","title":"Synthetically controlled bandits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.389455Z"},"links":{"cited_paper":"/paper/2202.07079","citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:dbedff013de40d0e7794fa9523908cefb2a8baa7ab18f5cddde515fa2d28e864","observation_id":"0ae4a0ee-641e-4b1d-b6b5-18d94d290788","resolution":{"observed_at":"2026-07-30T22:19:16.389455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.406817Z","title":"Best arm identification with minimal regret","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.406817Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:fad6d74dc17a069c1d5feae20257ab8ee2a41e5c774aa4b01ac5232d0d2c7577","observation_id":"40d14575-9f01-43c5-aebf-57827a67cc8c","resolution":{"observed_at":"2026-07-30T22:19:16.406817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10592","last_updated":"2024-07-30T08:48:04Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T11:27:48Z","title":"Optimizing Adaptive Experiments: A Unified Approach to Regret Minimization and Best-Arm Identification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10592","snapshot_observed_at":"2026-07-30T22:19:16.396798Z","title":"Optimizing adaptive experiments: A unified approach to regret minimization and best-arm identification.arXiv preprint arXiv:2402.10592,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.396798Z"},"links":{"cited_paper":"/paper/2402.10592","citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:ce6298d0163f09e6b01f417399210dd3cd5f4b375f00b1d2346c9637211aa109","observation_id":"adf93f16-5f70-4a7e-a683-d333e664ed95","resolution":{"observed_at":"2026-07-30T22:19:16.396798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00096","last_updated":"2024-05-22T20:13:30Z","snapshot_observed_at":"2026-08-05T21:25:03.501056Z","submitted_at":"2023-05-31T18:15:09Z","title":"Learning the Pareto Front Using Bootstrapped Observation Samples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00096","snapshot_observed_at":"2026-07-30T22:19:16.393248Z","title":"Learning the pareto front using bootstrapped observation samples.arXiv preprint arXiv:2306.00096,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.393248Z"},"links":{"cited_paper":"/paper/2306.00096","citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:485b88e13d1ae242bec225e1c30adc9445a0a10e6831880ed5a556402a3e657e","observation_id":"9f56c8a0-aa6e-4094-a7b3-e2c783277adc","resolution":{"observed_at":"2026-07-30T22:19:16.393248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.382071Z","title":"Beatriz Pessoa de Araujo and Adam Robbins","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.382071Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:1df12282e9dcc984ae16d8648dab89fe853ee8e7965ec9d3fb4ade5136ce874f","observation_id":"9df464bf-26d5-43ef-a65e-f74c49757060","resolution":{"observed_at":"2026-07-30T22:19:16.382071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.370418Z","title":"Best arm identification in multi-armed bandits","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.370418Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:62ba82882f4b5ba4a170c290b1d80059694425de6c05f0c0da536c62a3d92e9d","observation_id":"79d53273-a44a-443d-815a-471d1456506c","resolution":{"observed_at":"2026-07-30T22:19:16.370418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.400186Z","title":"Regret distribution in stochastic bandits: Optimal trade-off between expectation and tail risk.arXiv preprint arXiv:2304.04341,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.400186Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:038812da6f08ccc057f00ada6f2b77072f129b0185d8cdaa8bf7bb2e135e553b","observation_id":"6ddb04e7-c24d-4527-859c-472354854044","resolution":{"observed_at":"2026-07-30T22:19:16.400186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.403687Z","title":"Accessed 2026- 01-31","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.403687Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:437f93f8b0d2bd68040d8b849d7a612c0bd52e37869e987d8b34b63dd39d2328","observation_id":"209f9bef-8dcb-442f-b81e-6adc84ab2cd0","resolution":{"observed_at":"2026-07-30T22:19:16.403687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.378401Z","title":"Sébastien Bubeck, Rémi Munos, and Gilles Stoltz","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.378401Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:c2764524829a8992cc7609dd02b6126b8a8599533bd0c225e05227658d26ed1b","observation_id":"44eaf60e-d5f9-4d3e-b8c7-9d3f8de089fb","resolution":{"observed_at":"2026-07-30T22:19:16.378401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T01:03:42.061309Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2607.23432."}