{"as_of":"2026-08-10T06:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a32dd97c0b5030747dbc9affc0f8971137dcb6f4eec217c4339374bd5c6cc2d6","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:06:20.486932Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.02486/citation-record","integrity":"/paper/2502.02486/integrity","json":"/paper/2502.02486/citation-record.json","paper":"/paper/2502.02486"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1406.6812","last_updated":"2014-06-26T08:57:05Z","snapshot_observed_at":"2026-08-10T04:18:33.114699Z","submitted_at":"2014-06-26T08:57:05Z","title":"Online learning in MDPs with side information","version":1},"cited_work":{"arxiv_id":"1406.6812","doi":null,"metadata_source":"pith","pith_arxiv_id":"1406.6812","snapshot_observed_at":"2026-08-09T12:06:20.849547Z","title":"Online learning in MDPs with side information","venue":"cs.LG","work_id":"8d7ac29b-2391-4b30-90de-e2ee602e2390","year":2014},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.283510Z"},"links":{"cited_paper":"/paper/1406.6812","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:dcb79ff7c414308897e2984849157ffc497090cc53681fc675cef662eb83574a","observation_id":"b1d9a221-a4bf-4f1e-af70-8fade455437a","resolution":{"observed_at":"2026-08-09T12:06:20.854120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.288875Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.288875Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:17ec6f10b99ef6355dcfcc713980946252e325250ca9c7f96f641a519b88de55","observation_id":"b2f45b8d-0ec5-4963-a315-3b175a669495","resolution":{"observed_at":"2026-08-09T12:06:20.288875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.230262Z","title":null,"venue":null,"work_id":"f77a6128-d1f2-418c-8c96-fc7f9bef1157","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.293092Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:cd1932f889a5ea8977c2318cc7b6634316144671bb9222e935ef70b576d9a3b7","observation_id":"b57e6b4e-a661-4393-b26b-c9cc6c01c750","resolution":{"observed_at":"2026-08-09T12:06:21.234114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.218786Z","title":"and Catoni, O","venue":null,"work_id":"d47c1286-10b0-46dd-b0bb-7740ac9f4cf9","year":2011},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.297750Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:45f182e839007a779a939c7d6eb3f9f8037c2a38a7934f1963efc87cc720bcfd","observation_id":"6de77f9f-85a0-46e6-b97c-fc32cb7a5c2b","resolution":{"observed_at":"2026-08-09T12:06:21.222744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.206822Z","title":null,"venue":null,"work_id":"f1d44292-584a-4e63-b576-0911c8d8c663","year":2013},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.302131Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:10b71c14da1984d54525a02944a8d0aa8ce5fad4be09fbd7936cb92deaf1c331","observation_id":"c2c1025e-23d9-483b-ac7d-0e58dda4df04","resolution":{"observed_at":"2026-08-09T12:06:21.210616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.192629Z","title":"F., Balseiro, S","venue":null,"work_id":"4c1af141-af51-4e5b-b45d-9e397224df9b","year":2020},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.306282Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:8a3fdc0a662ffbbf77cfbd06ace85737c8e629efe3da9397e33f539a5726e784","observation_id":"2c36c767-46f1-46f2-a959-d25613b4395c","resolution":{"observed_at":"2026-08-09T12:06:21.198026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.179635Z","title":null,"venue":null,"work_id":"73433fcf-1ed0-4426-973b-0efa077eabbe","year":2011},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.311181Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:034d3c0712c5d642595aab3cb191c42523930a6bf8c66735837e9ea1462d93f5","observation_id":"59ee96c3-41c4-4612-a957-ac646f1834e0","resolution":{"observed_at":"2026-08-09T12:06:21.184770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.166930Z","title":null,"venue":null,"work_id":"7c0facfb-949d-4e10-8273-fc916d4e6784","year":2001},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.315387Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:0336742e232ae81dada64583392c8b8218c007512933bc435aff23940f43f724","observation_id":"b0b273fe-0523-48d1-b57d-e12f843d0f23","resolution":{"observed_at":"2026-08-09T12:06:21.170750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.154903Z","title":null,"venue":null,"work_id":"d9a54724-fe54-4cab-8664-bb6d65edfb33","year":2022},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.319418Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:8dcca9f663187f34e80441fd18afeb477f400eafb3317a32ac7ce5bc016e095a","observation_id":"7de8728b-8cc2-42d9-9e4f-816e59e6c902","resolution":{"observed_at":"2026-08-09T12:06:21.159206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.142124Z","title":null,"venue":null,"work_id":"4f605ead-ef96-40b6-b013-48dcb1c54683","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.323336Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:13286829c6f1f9fe95388dd7ae8f210880ddee731c46e893bb10e5c002242c63","observation_id":"c9bdab7f-89f0-40f7-87c9-dc7094898b17","resolution":{"observed_at":"2026-08-09T12:06:21.146250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.128855Z","title":null,"venue":null,"work_id":"54484421-e812-47a6-bb92-055fabe3a971","year":2022},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.327768Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:3e43dade9079274fcd903f33a320cc386d45d3915cdbba05bc09e0a54f8d5c10","observation_id":"3e912f57-d7e4-4c8c-afa3-9061dd6b2f73","resolution":{"observed_at":"2026-08-09T12:06:21.133627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.114651Z","title":null,"venue":null,"work_id":"f4439b6f-f5af-451b-b6e2-e625fe944d03","year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.332319Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:32ab4c9e355aa0fab5aa9f479683463af8754fdde02ee5a179e4de558b39c574","observation_id":"d04aea70-796e-4773-9686-0efec6ee7d00","resolution":{"observed_at":"2026-08-09T12:06:21.118760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.101172Z","title":null,"venue":null,"work_id":"1cebb8bd-3c68-462b-b0b1-34f015f3bff3","year":2012},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.336068Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:bad640e1703fd5572d919065c6a2f3f7f0470c072797315a0c4c3aa813a29402","observation_id":"0c535ddc-a5a4-47e7-8b2a-fcbb91936a1d","resolution":{"observed_at":"2026-08-09T12:06:21.105422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.088671Z","title":"I., Morshed, Z., Shankar, A., Arli, D., and Pentecost, R","venue":null,"work_id":"39fb82e2-5022-41bb-a154-b23d8c0b04f9","year":2021},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.340432Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:307888d7c8289a9ce1de5f2a13f7f4070e7c60edb96ac7aaf6c68b6adde5c8d9","observation_id":"9f54c63c-6aa3-4c90-868e-8e70cda9ce92","resolution":{"observed_at":"2026-08-09T12:06:21.092755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.03289","last_updated":"2023-02-04T21:49:44Z","snapshot_observed_at":"2026-08-05T12:35:47.842990Z","submitted_at":"2021-11-05T06:47:27Z","title":"Improved Regret Analysis for Variance-Adaptive Linear Bandits and Horizon-Free Linear Mixture MDPs","version":4},"cited_work":{"arxiv_id":"2111.03289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.03289","snapshot_observed_at":"2026-08-09T12:06:20.831745Z","title":"Improved Regret Analysis for Variance-Adaptive Linear Bandits and Horizon-Free Linear Mixture MDPs","venue":"stat.ML","work_id":"18764a09-3527-4256-98c5-847c59177659","year":2021},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.344733Z"},"links":{"cited_paper":"/paper/2111.03289","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:8db9a6d2a3ab5c4ef746567739b689df6de2a6c5d446e25b4a79e46503993cf8","observation_id":"c034341c-f12a-4871-bcc8-3e228f1de5d5","resolution":{"observed_at":"2026-08-09T12:06:20.836248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.076244Z","title":"and Sun, Q","venue":null,"work_id":"c93bb49d-b176-4c89-aa23-d3058c9ef581","year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.358477Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:729a96c6b10b5cac7faec07c9191813ae40e79717ca60d71acc4bec80d764e8c","observation_id":"c020fbf2-9808-4c56-a243-ae5296575bf2","resolution":{"observed_at":"2026-08-09T12:06:21.080495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.062002Z","title":"and Mendelson, S","venue":null,"work_id":"145ec1da-ff92-4905-af3f-25b0355a8d2d","year":2019},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.363488Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:e344b857d36cfc3104bd5da254fba9c70fae6f0d5fd6af11ae3695f2fefb01a5","observation_id":"341a3287-5289-4259-9d57-0e044c092e2e","resolution":{"observed_at":"2026-08-09T12:06:21.067482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.047919Z","title":null,"venue":null,"work_id":"0545a0b1-e96a-4bda-8b7c-8397b965193d","year":2016},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.367975Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:f3e44c9f39edf2021858173758b5ca71953438d20c2a926cd0442f3aaa83e7e4","observation_id":"ae5bdc00-c717-46fb-bb66-76ba6602dfc3","resolution":{"observed_at":"2026-08-09T12:06:21.052190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.033941Z","title":null,"venue":null,"work_id":"d165f515-1d41-41c2-987f-8756a2dde167","year":2013},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.372233Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:f5d9356c832ba22250188a798ca56486713892bcab77f57673e629d69f3a79bc","observation_id":"4fb69c8c-c38a-4f72-9401-2211f25acba7","resolution":{"observed_at":"2026-08-09T12:06:21.038877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16197","last_updated":"2025-03-15T19:53:31Z","snapshot_observed_at":"2026-07-30T22:06:40.789861Z","submitted_at":"2024-09-24T15:42:04Z","title":"Second Order Bounds for Contextual Bandits with Function Approximation","version":3},"cited_work":{"arxiv_id":"2409.16197","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.16197","snapshot_observed_at":"2026-08-09T12:06:20.814598Z","title":"Second Order Bounds for Contextual Bandits with Function Approximation","venue":"cs.LG","work_id":"5041ffed-e727-423d-8e98-38925800ad19","year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.376466Z"},"links":{"cited_paper":"/paper/2409.16197","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:3eb363de882b3bf03d99bb11dfd36c0ec696752e05b06094ef6de02054dce57c","observation_id":"15d1be39-2c24-4da7-b2d5-cb6e89fbc349","resolution":{"observed_at":"2026-08-09T12:06:20.819090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.019382Z","title":"and Van Roy, B","venue":null,"work_id":"52dbd665-14f2-4d38-aa47-d43131bf0d81","year":2013},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.381410Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:6cb6ae0b285684ba0169fcee01090c95b796c682278eda025ca94a7194da1626","observation_id":"54e81fdd-147c-4178-81e9-80feffdd0ef3","resolution":{"observed_at":"2026-08-09T12:06:21.023815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.003313Z","title":null,"venue":null,"work_id":"792ceb02-271e-4c1a-bdd7-f56263911cc6","year":2018},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.385999Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:b2b0beb1277eb57f5eb643e62a6c0b18eab8d4bb1e50eb3bb209f1ea23a97214","observation_id":"ec3791c4-e5df-49af-8705-eeb0f54f3f3e","resolution":{"observed_at":"2026-08-09T12:06:21.009268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.981223Z","title":"J., Chen, Y., Simchowitz, M., Du, S., and Jamieson, K","venue":null,"work_id":"c6272161-1fa1-4f63-aaae-33e90b0ff783","year":2022},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.393218Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:83a5be6530be10d9bd6009b1cf41a70ef8b1d36d85f2635fca30db83348b5dfa","observation_id":"29a0419c-f20e-49b3-aaa1-9b1b6db156f0","resolution":{"observed_at":"2026-08-09T12:06:20.985432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.400012Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.400012Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:282055a097c62381990e063defa303ba02ab55309c5e1f6cb51bc87893415216","observation_id":"f1531abe-75f5-45d1-853c-54a06a51e006","resolution":{"observed_at":"2026-08-09T12:06:20.400012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12799","last_updated":"2025-04-04T15:09:19Z","snapshot_observed_at":"2026-07-06T19:18:12.969683Z","submitted_at":"2024-09-19T14:10:38Z","title":"The Central Role of the Loss Function in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12799","snapshot_observed_at":"2026-08-09T12:06:20.404876Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.404876Z"},"links":{"cited_paper":"/paper/2409.12799","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:0cf06ee1856c6435c5139f942b54e2e80bb5d31c5e049484b1d3d89b9e06ed0b","observation_id":"b7ac19de-ab35-4128-b605-1bb08e839728","resolution":{"observed_at":"2026-08-09T12:06:20.404876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07198","last_updated":"2024-02-11T13:25:53Z","snapshot_observed_at":"2026-07-06T17:28:35.548657Z","submitted_at":"2024-02-11T13:25:53Z","title":"More Benefits of Being Distributional: Second-Order Bounds for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07198","snapshot_observed_at":"2026-08-09T12:06:20.410377Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.410377Z"},"links":{"cited_paper":"/paper/2402.07198","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:c4fbfa3cb261200eccaec27bc61b049ebcc4ecbb7a6ad6111d381c3c6193b160","observation_id":"e436da6d-d4cb-4263-92f1-287d22690f4f","resolution":{"observed_at":"2026-08-09T12:06:20.410377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08994","last_updated":"2024-10-29T08:21:36Z","snapshot_observed_at":"2026-08-04T04:56:50.498092Z","submitted_at":"2024-08-16T19:52:53Z","title":"Model-based RL as a Minimalist Approach to Horizon-Free and Second-Order Bounds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08994","snapshot_observed_at":"2026-08-09T12:06:20.417142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.417142Z"},"links":{"cited_paper":"/paper/2408.08994","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:feb41158419c8cf03c9c51bb164833e352b7110492acc36152bb8ad6c11e0e85","observation_id":"8ed37462-15c2-4d2f-8cb9-1b049606e019","resolution":{"observed_at":"2026-08-09T12:06:20.417142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.959720Z","title":null,"venue":null,"work_id":"6cd88ccb-3384-4881-8bcf-e471c7729def","year":2020},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.424035Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:7c43df4a189d54b50101435f9bb3fbf4fd01df20c80a1d8fbcb9e7881cb74024","observation_id":"16ad6c04-3058-478a-adbd-26fdba486654","resolution":{"observed_at":"2026-08-09T12:06:20.964184Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.13465","last_updated":"2020-04-28T13:01:38Z","snapshot_observed_at":"2026-08-08T13:59:49.702216Z","submitted_at":"2020-04-28T13:01:38Z","title":"Nearly Optimal Regret for Stochastic Linear Bandits with Heavy-Tailed Payoffs","version":1},"cited_work":{"arxiv_id":"2004.13465","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.13465","snapshot_observed_at":"2026-08-09T12:06:20.758525Z","title":"Nearly Optimal Regret for Stochastic Linear Bandits with Heavy-Tailed Payoffs","venue":"cs.LG","work_id":"7141a2a4-7bea-4ec7-94cd-642568cbbc17","year":2020},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.429874Z"},"links":{"cited_paper":"/paper/2004.13465","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:0a9de153eec36c96d5aaaeae3b3627292f412c4c97608a4f65863c859b816ce0","observation_id":"0ece84ef-eaf1-49ed-bb16-12d98a199311","resolution":{"observed_at":"2026-08-09T12:06:20.763222Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08991","last_updated":"2024-07-20T15:23:25Z","snapshot_observed_at":"2026-08-07T00:44:56.876662Z","submitted_at":"2024-02-14T07:27:30Z","title":"Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08991","snapshot_observed_at":"2026-08-09T12:06:20.434468Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.434468Z"},"links":{"cited_paper":"/paper/2402.08991","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:56334245cd6572565c9b383bb4a3774c2f80b361def327d7832b5a869b933282","observation_id":"0626df87-5020-44cd-bd9e-b2b1614a23c1","resolution":{"observed_at":"2026-08-09T12:06:20.434468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.440710Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.440710Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:1223795a8fa21ac706a86b78b03d66757fcd4f56e819cee1441413e5faf99b58","observation_id":"ec77caab-5c9f-4390-a1e3-58e13d744745","resolution":{"observed_at":"2026-08-09T12:06:20.440710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.932144Z","title":null,"venue":null,"work_id":"5a02f21d-9d7c-4cf9-8cbf-33caa35c0377","year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.450109Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:3a2d3f24b08bc62f6ee6ef014d8820e283273584cba685fb4ddf24857e06fb02","observation_id":"6aa46686-cbc8-4f83-bc8d-9452a544e64a","resolution":{"observed_at":"2026-08-09T12:06:20.938143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.917801Z","title":null,"venue":null,"work_id":"16dd641e-496c-4360-85e1-1fb3e97d14d8","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.458660Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:889e0eabb884be8d4e6b95f1d12d315d0ff8cfb4ffa3b2ae9583fd61304a6af6","observation_id":"fc5ef3ee-7a32-4c6c-871b-8e833529be12","resolution":{"observed_at":"2026-08-09T12:06:20.922508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.904545Z","title":null,"venue":null,"work_id":"c34d8608-fb83-4709-899d-1484c9916c89","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.462987Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:2b10863a19ee2b40182c1366b471fbcfa45f4b14cbd5457710da62ce33d77ea3","observation_id":"bbd8488d-a755-4439-a75f-764ed5f052d2","resolution":{"observed_at":"2026-08-09T12:06:20.909191Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.890033Z","title":null,"venue":null,"work_id":"5dbcd34d-f113-430b-9e62-0e07881cb897","year":2021},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.468023Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:ad84abe378d7ef69892f9a33f819a4df71a846b599363cffc0a932f4bb545134","observation_id":"0d9ce622-ddb8-4814-aca3-8376b7b64f53","resolution":{"observed_at":"2026-08-09T12:06:20.894884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.472369Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.472369Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:9616f7c74f250ae619bc215460185dcdefaf8e3a80ea1a114ef39b96fd8686cc","observation_id":"a9c2316d-8592-4ce6-8a35-3bfd8612935e","resolution":{"observed_at":"2026-08-09T12:06:20.472369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.876510Z","title":null,"venue":null,"work_id":"31fb7469-03b5-4b6d-9d17-c9218bba5e0b","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.476482Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:6a4a71bacea33048937c66846d821069cf2a4d2dcf10bd7e7494f6bffdcee1b4","observation_id":"3ae9286f-423a-4783-9275-fff8d5287511","resolution":{"observed_at":"2026-08-09T12:06:20.880942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11507","last_updated":"2022-05-23T17:59:18Z","snapshot_observed_at":"2026-07-06T13:12:59.688989Z","submitted_at":"2022-05-23T17:59:18Z","title":"Computationally Efficient Horizon-Free Reinforcement Learning for Linear Mixture MDPs","version":1},"cited_work":{"arxiv_id":"2205.11507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.11507","snapshot_observed_at":"2026-08-09T12:06:20.526457Z","title":"Computationally Efficient Horizon-Free Reinforcement Learning for Linear Mixture MDPs","venue":"cs.LG","work_id":"4ca075a8-dd1e-4623-877b-b4f06f10557c","year":2022},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.481935Z"},"links":{"cited_paper":"/paper/2205.11507","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:3f906f270f5944d0464d93f74e0c03086dd6108b7bf16bfbceaf26e893de199a","observation_id":"25f15fd8-a4a5-4487-9e0b-e86681fd50a7","resolution":{"observed_at":"2026-08-09T12:06:20.533550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.863211Z","title":null,"venue":null,"work_id":"c0e41c98-a390-4210-b85b-fa00c50244a8","year":2021},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.486932Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:c87656b7695827eed77b6cef5b56b262d2f5d8c11e7737dced634e92cf1dc1d2","observation_id":"b39f8a24-8f3d-4d57-b6a1-72101e6dad0e","resolution":{"observed_at":"2026-08-09T12:06:20.867668Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":5,"verified_fuzzy":7},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2502.02486."}