{"as_of":"2026-08-08T17:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bd07e622bfbb38a3c3adf40bfcf5fd83ee4d35487f3573c2fbf7ec997a431e9","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:08:35.693456Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.12152/citation-record","integrity":"/paper/2510.12152/integrity","json":"/paper/2510.12152/citation-record.json","paper":"/paper/2510.12152"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.583366Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.583366Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:e3c7a5c516149ca61d58f40bf0b607e18de03ac01c1c05d187af7d0fe2dc71f1","observation_id":"8b2e1561-a487-42fe-8183-20b87ccfeffe","resolution":{"observed_at":"2026-08-04T10:08:31.583366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.637586Z","title":"Fighting bandits with a new kind of smoothness","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.637586Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:3979ab96d3712b9b36a265b1addd1dd4fa43435694f651c5a355a9f78defab34","observation_id":"e541812b-f769-46d6-a82b-6567182fc513","resolution":{"observed_at":"2026-08-04T10:08:31.637586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.699787Z","title":"The nonstochastic multiarmed bandit problem","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.699787Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:5bdf20df3bc67bb19959abac0da8299dac68e88a61192b948321628db249dde7","observation_id":"2bbb536a-e2d6-465c-9cd5-b138d073dab4","resolution":{"observed_at":"2026-08-04T10:08:31.699787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.743170Z","title":"Decoupling exploration and exploitation in multi-armed bandits","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.743170Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:209a055da428236ca501f593a045bde9b688b3c73581dd4b7e26a71716dba0ac","observation_id":"282e5612-477d-4c2c-becd-fe889bd7bdcc","resolution":{"observed_at":"2026-08-04T10:08:31.743170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.795159Z","title":"Bandit algorithms for e-commerce recommender systems","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.795159Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:5763672204363a71b4f1347c0a83b191797266a91ff8ee89a4a51d4e4657a855","observation_id":"0a1c484e-1ea1-4d6a-8c8b-3ccff044cfa8","resolution":{"observed_at":"2026-08-04T10:08:31.795159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.849827Z","title":"Five miracles of mirror descent, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.849827Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:ce8b3d2747bef01eb63b554abb8964792891a389ce3e5188bdbb25df3d2227f5","observation_id":"3e0a3ebc-41ab-41c3-80fd-281afc2f3ee6","resolution":{"observed_at":"2026-08-04T10:08:31.849827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.905844Z","title":"Regret analysis of stochastic and nonstochastic multi-armed bandit problems","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.905844Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:bf34b12c918cd5e66fdeddee352c00845c478e4fbee4bd0deb634b33cc102657","observation_id":"4fdd0aa5-dc12-4b4f-ae22-9dcab4e02cb8","resolution":{"observed_at":"2026-08-04T10:08:31.905844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.963263Z","title":"The best of both worlds: Stochastic and adversarial bandits","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.963263Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:6fb1e64da2dd435794e20353dbedfaf5e75dcb741fdebd116fb03ca1583aeb24","observation_id":"81d367f8-68fd-4099-9e69-9abc30cd7ac7","resolution":{"observed_at":"2026-08-04T10:08:31.963263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00757","last_updated":"2015-11-03T18:37:43Z","snapshot_observed_at":"2026-08-03T21:30:46.125285Z","submitted_at":"2015-10-02T23:28:11Z","title":"A Survey of Online Experiment Design with the Stochastic Multi-Armed Bandit","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00757","snapshot_observed_at":"2026-08-04T10:08:32.022880Z","title":"A survey of online experiment design with the stochastic multi-armed bandit","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.022880Z"},"links":{"cited_paper":"/paper/1510.00757","citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:eb852965ad791f15b13313291453f9082594a4c45b5c6220989ba2b72d588814","observation_id":"5ae193ea-4ef8-4932-b117-789e3bbff22f","resolution":{"observed_at":"2026-08-04T10:08:32.022880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03324","last_updated":"2025-06-03T19:14:53Z","snapshot_observed_at":"2026-08-07T11:04:00.209732Z","submitted_at":"2025-06-03T19:14:53Z","title":"Optimization of Epsilon-Greedy Exploration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03324","snapshot_observed_at":"2026-08-04T10:08:32.141050Z","title":"Optimization of epsilon-greedy exploration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.141050Z"},"links":{"cited_paper":"/paper/2506.03324","citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:f43f8a876abbcc3c049631181bdfb94e3db81a137b2ba08951271aaf1f6ae273","observation_id":"1e14f41d-a43b-4a9e-b494-370aea945480","resolution":{"observed_at":"2026-08-04T10:08:32.141050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.306226Z","title":"Geometric resampling in nearly linear time for Follow-the-Perturbed-Leader with Best-of-Both-Worlds guarantee in bandit problems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.306226Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:9ee5b11e02763707c90d7d6106d8943f4921ae2f8fe20a5b114546f303887213","observation_id":"7c56f155-a18f-4415-8e7c-30976d4ad614","resolution":{"observed_at":"2026-08-04T10:08:32.306226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.492703Z","title":"Action elimination and stopping conditions for the multi-armed bandit and reinforcement learning problems","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.492703Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:95db67ab6fbfd8c244d83102c9198747711e6ca14cb1ba26a41413a27afb1fd0","observation_id":"4070d39e-dd31-4c0b-98d3-91e5ac927278","resolution":{"observed_at":"2026-08-04T10:08:32.492703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.653283Z","title":"On explore-then-commit strategies","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.653283Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:69431e62ad5af615c9c7229bee6e722ef504035e526efa4b40128d8ae20f73fd","observation_id":"af83966e-fafb-4790-9e95-e9f2e46b9546","resolution":{"observed_at":"2026-08-04T10:08:32.653283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.739844Z","title":"Follow-the-Perturbed-Leader achieves Best-of-Both-Worlds for bandit problems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.739844Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:0e4375283139e9f1558440f79a46353c0707206fd014534f296bee88d0a12bbf","observation_id":"85ee46ac-06be-48dc-bd0d-43cc2ac8459f","resolution":{"observed_at":"2026-08-04T10:08:32.739844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.908261Z","title":"Adaptive learning rate for Follow-the-Regularized-Leader : Competitive analysis and Best-of-Both-Worlds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.908261Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:f70d24738356cfc7458a5ae88321b76642675df362c332ee4cab965f0c88eb2b","observation_id":"fd173f7b-364c-4ac8-a834-fd5652efcdc7","resolution":{"observed_at":"2026-08-04T10:08:32.908261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.089293Z","title":"Improved Best-of-Both-Worlds guarantees for multi-armed bandits: FTRL with general regularizers and multiple optimal arms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.089293Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:d601d01dfbdd6eac44078889a481110552474e991a7a6070577cc69b8a25cb9a","observation_id":"7aba412f-9013-4fcb-a435-a88ec9fa3015","resolution":{"observed_at":"2026-08-04T10:08:33.089293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.227646Z","title":"An -best-arm identification algorithm for fixed-confidence and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.227646Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:e0b5925f140d05ae880cd50e5c5fe1161fb7a495978dd340579192c1e48328f2","observation_id":"f5e91056-a704-4e3a-9107-d03a4d61c295","resolution":{"observed_at":"2026-08-04T10:08:33.227646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.406411Z","title":"On the optimality of perturbations in stochastic and adversarial multi-armed bandit problems","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.406411Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:df166a064ca9b94b9d0741476bf60154a7754c88402c6d81c36fcc0a2f0d2105","observation_id":"8105a29d-78af-4284-82c0-304c68afeef9","resolution":{"observed_at":"2026-08-04T10:08:33.406411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.598175Z","title":"Follow-the-Perturbed-Leader with F r\\'echet-type tail distributions: Optimality in adversarial bandits and best-of-both-worlds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.598175Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:823b52c787e2deb9018d380e61f86696eca957869cdaf335170201657755cf2f","observation_id":"593e55c9-e3be-4e5e-b0f2-b73fa619449a","resolution":{"observed_at":"2026-08-04T10:08:33.598175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.738612Z","title":"Revisiting Follow-the-Perturbed-Leader with unbounded perturbations in bandit problems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.738612Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:04f0539cd5592b6daf2832752762806d92ea2c62cc12164c12f18087c5c574da","observation_id":"6d8b16d7-d1ef-4672-800b-4784a17020b0","resolution":{"observed_at":"2026-08-04T10:08:33.738612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.844790Z","title":"Schwartz, and Jacob Abernethy","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.844790Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:109ea3078f899a337cbb28145f2d8d27e83c636698b649cee7cce05113a765f1","observation_id":"cb2659cc-c4ab-433f-83b5-93d7c7cc5b92","resolution":{"observed_at":"2026-08-04T10:08:33.844790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.987126Z","title":"Low-rank bandit methods for high-dimensional dynamic pricing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.987126Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:2375afe5b750b2e8ca9d2a58476f42a9228c2fe6ef9269522bd60e58f8bc8e7e","observation_id":"7f873626-0803-4699-85e1-e466c3959a7b","resolution":{"observed_at":"2026-08-04T10:08:33.987126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.050481Z","title":"Importance weighting without importance weights: An efficient algorithm for combinatorial semi-bandits","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.050481Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:1e2e5494c2ecd41708bb6930ac778c79a7dcfa999ee4e9a18f1c64e7229d8cb1","observation_id":"e94a06b5-e559-4839-8d97-622e132d28c7","resolution":{"observed_at":"2026-08-04T10:08:34.050481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.109425Z","title":"Conic optimization via operator splitting and homogeneous self-dual embedding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.109425Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:d14567026c5a5270f9d20f1f3407d5df156ad252b85b60111ee65534af7d9184","observation_id":"d1f195b8-ab4e-4d32-9f27-6f3251520ba6","resolution":{"observed_at":"2026-08-04T10:08:34.109425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.171912Z","title":"NIST handbook of mathematical functions hardback and CD-ROM","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.171912Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:056f7b63b656cb4be7dd487b6459c3bfb96d6ac0ac0f0f5d06b69c267c1067bd","observation_id":"0a40b282-1cff-46b3-916c-130cee3ceb22","resolution":{"observed_at":"2026-08-04T10:08:34.171912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.262254Z","title":"Tsallis-inf for decoupled exploration and exploitation in multi-armed bandits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.262254Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:b893cbc6b9783fc869309a03094e121fae6c978ef3897d74a9be9895a9444674","observation_id":"0a5b5b7f-19be-438d-bb23-1fbbea30172c","resolution":{"observed_at":"2026-08-04T10:08:34.262254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.399273Z","title":"Follow the perturbed leader: Optimism and fast parallel algorithms for smooth minimax games","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.399273Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:cbd90e4bf42087966f85387a111681642cd56f253747eb99777790b542b982ee","observation_id":"48528644-b780-412c-b2c6-e81a547e0dfc","resolution":{"observed_at":"2026-08-04T10:08:34.399273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.538073Z","title":"Stability-penalty-adaptive follow-the-regularized-leader: Sparsity, game-dependency, and best-of-both-worlds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.538073Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:0437bc43ef0f2d6f6998892de8cfbdc6f049aa4f114c3facc9978b7e7b7b3a22","observation_id":"e7a8c603-6efc-40d6-b8a7-ead6231ae691","resolution":{"observed_at":"2026-08-04T10:08:34.538073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.674566Z","title":"More adaptive algorithms for adversarial bandits","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.674566Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:23ffd5a79e96f9b0cce361ad4fed5c0bf13d06b1d144b7199ecef281c148a492","observation_id":"5ae7962a-492c-490c-937d-5eaa3135ef06","resolution":{"observed_at":"2026-08-04T10:08:34.674566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07307","last_updated":"2025-07-07T14:25:36Z","snapshot_observed_at":"2026-08-07T16:07:02.808962Z","submitted_at":"2025-04-09T22:07:01Z","title":"Follow-the-Perturbed-Leader Approaches Best-of-Both-Worlds for the m-Set Semi-Bandit Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07307","snapshot_observed_at":"2026-08-04T10:08:34.818772Z","title":"Follow-the-perturbed-leader approaches best-of-both-worlds for the m-set semi-bandit problems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.818772Z"},"links":{"cited_paper":"/paper/2504.07307","citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:0bcfaca514690b40c55907681738d284915115563c40629ffda35537f602b36c","observation_id":"cfc70a12-31a9-4877-8d0f-23c7a67d0df1","resolution":{"observed_at":"2026-08-04T10:08:34.818772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.942014Z","title":"Sim-to-real transfer in deep reinforcement learning for robotics: a survey","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.942014Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:f57111740cfc879038ccecf6e3b26d90feb92842ee24da3b85ce7a65580b3866","observation_id":"50616895-bab8-4fd3-b83a-27cab1436c84","resolution":{"observed_at":"2026-08-04T10:08:34.942014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:35.054270Z","title":"Large-scale bandit approaches for recommender systems","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.054270Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:82e1eba2e3f24103e9b73c8c20795f19ce100f247b367268097e2c5504b9e80a","observation_id":"e8105c46-a957-420f-97b5-dd5e03d762e6","resolution":{"observed_at":"2026-08-04T10:08:35.054270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:35.171506Z","title":"Tsallis- INF : A n optimal algorithm for stochastic and adversarial bandits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.171506Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:9ec71fada525e443dbfe889d498815c6aa599085b2cb6b6f6169b124ff1e170f","observation_id":"81832b05-4320-4fe2-b84c-5163929192d9","resolution":{"observed_at":"2026-08-04T10:08:35.171506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:35.373349Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.373349Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:13d9dd7742687bf6513ed4af5e09aece7d9c577f83f759a2ab6c39d37a9a7335","observation_id":"e3ed60d5-f6f9-42a4-9ce7-df3f400b1b0a","resolution":{"observed_at":"2026-08-04T10:08:35.373349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:35.560570Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.560570Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:c8934dfa952aac438fea6ebd27cdfb16afe2f0445237184e2ba9f58a6f78233b","observation_id":"eb280f17-edba-4edc-b93a-1f3917e301bb","resolution":{"observed_at":"2026-08-04T10:08:35.560570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20028","last_updated":"2025-02-16T19:26:49Z","snapshot_observed_at":"2026-07-06T18:22:40.048076Z","submitted_at":"2024-05-30T13:13:12Z","title":"A Simple and Adaptive Learning Rate for FTRL in Online Learning with Minimax Regret of $\\Theta(T^{2/3})$ and its Application to Best-of-Both-Worlds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20028","snapshot_observed_at":"2026-08-04T10:08:35.693456Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.693456Z"},"links":{"cited_paper":"/paper/2405.20028","citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:3c358b0d0d636bd91b6ec6b05b10ce7c4311fe8870bc5b9d7c15143801a13114","observation_id":"af35d759-7b1c-4c33-a4f4-7434c274fe1c","resolution":{"observed_at":"2026-08-04T10:08:35.693456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-04T20:36:29.716485Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2510.12152."}