{"as_of":"2026-08-08T17:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a876b432c4f955a3b4acaaf5d24133aabd1be19500fab7867bc2f9f1dfd7f30f","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:57:04.463584Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-05T10:20:16.326364Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-05T10:20:57.158448Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"cited_work":{"arxiv_id":"2502.10020","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.10020","snapshot_observed_at":"2026-07-05T10:20:57.158448Z","title":"Lee and M.-h","venue":null,"work_id":"46be6677-8c24-4249-ad26-44de1ff7def4","year":2025},"citing_paper":{"arxiv_id":"2604.18800","last_updated":"2026-05-23T23:42:14Z","snapshot_observed_at":"2026-07-06T23:05:35.374092Z","submitted_at":"2026-04-20T20:08:46Z","title":"Optimal Exploration of New Products under Assortment Decisions","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-10T02:54:16.836240Z"},"links":{"cited_paper":"/paper/2502.10020","citing_paper":"/paper/2604.18800"},"observation_digest":"sha256:87c15f415c12dc674054483b4d349b05e5d6e0cd7cf14031c8fad37876b00b71","observation_id":"ea485244-967c-49dc-a9d6-746bf542b833","resolution":{"observed_at":"2026-05-11T12:51:02.778637Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"cited_work":{"arxiv_id":"2502.10020","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.10020","snapshot_observed_at":"2026-07-05T10:20:57.158448Z","title":"Lee and M.-h","venue":null,"work_id":"46be6677-8c24-4249-ad26-44de1ff7def4","year":2025},"citing_paper":{"arxiv_id":"2604.18800","last_updated":"2026-05-23T23:42:14Z","snapshot_observed_at":"2026-07-06T23:05:35.374092Z","submitted_at":"2026-04-20T20:08:46Z","title":"Optimal Exploration of New Products under Assortment Decisions","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-05T10:20:16.326364Z"},"links":{"cited_paper":"/paper/2502.10020","citing_paper":"/paper/2604.18800"},"observation_digest":"sha256:577ec44de844f0ce8f2063ce012346fd98c455fc1187d08bb3e2ad74cbf9d699","observation_id":"1cb3e46c-1f32-45e8-a04f-0985611330cf","resolution":{"observed_at":"2026-07-05T10:20:57.160636Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"cited_work":{"arxiv_id":"2502.10020","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.10020","snapshot_observed_at":"2026-07-05T10:20:57.158448Z","title":"Lee and M.-h","venue":null,"work_id":"46be6677-8c24-4249-ad26-44de1ff7def4","year":2025},"citing_paper":{"arxiv_id":"2604.19008","last_updated":"2026-04-21T02:53:38Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T02:53:38Z","title":"Optimal Online and Offline Algorithms for Contextual MNL with Applications to Assortment and Pricing","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-10T02:33:24.470297Z"},"links":{"cited_paper":"/paper/2502.10020","citing_paper":"/paper/2604.19008"},"observation_digest":"sha256:1e976147497b75767ccb132140d1c5210ea6aada20bee02324dd2f64ec442aaa","observation_id":"4755ac94-62fb-4372-af46-e4ecdfe106fa","resolution":{"observed_at":"2026-05-11T12:56:19.300374Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"cited_work":{"arxiv_id":"2502.10020","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.10020","snapshot_observed_at":"2026-07-05T10:20:57.158448Z","title":"Lee and M.-h","venue":null,"work_id":"46be6677-8c24-4249-ad26-44de1ff7def4","year":2025},"citing_paper":{"arxiv_id":"2605.19768","last_updated":"2026-05-19T12:39:32Z","snapshot_observed_at":"2026-07-06T23:30:25.609722Z","submitted_at":"2026-05-19T12:39:32Z","title":"Minimax Optimal Variance-Aware Regret Bounds for Multinomial Logistic MDPs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T04:56:35.254081Z"},"links":{"cited_paper":"/paper/2502.10020","citing_paper":"/paper/2605.19768"},"observation_digest":"sha256:4706e1d24c02cfcb0c47af92e01337a52444390cff726f43894e296bed63712b","observation_id":"cc609e57-f4fe-4023-9cd3-8e58f7a5e6ea","resolution":{"observed_at":"2026-05-20T04:58:05.031716Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.10020/citation-record","integrity":"/paper/2502.10020/integrity","json":"/paper/2502.10020/citation-record.json","paper":"/paper/2502.10020"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.288347Z","title":"Instance-wise minimax-optimal algorithms for logistic bandits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.288347Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:eace15458a60bc4a36a7cfb4046a4a1e65a937bb26d3fe6cc0ef19d320ab9c11","observation_id":"4d77ca67-19d0-48ce-8074-84a0de452634","resolution":{"observed_at":"2026-08-07T19:57:04.288347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.294435Z","title":"A tractable online learning algorithm for the multinomial logit contextual bandit","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.294435Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:113754602c75cca90445cd7d0e86b674d19bc1cb7e1055ac7ad2f6af0922f0fd","observation_id":"8386362a-4e37-4f85-ae78-c312b0f2bf24","resolution":{"observed_at":"2026-08-07T19:57:04.294435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.299593Z","title":"Thompson sampling for the mnl-bandit","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.299593Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:16f273931aade8ba6d2d64097d8974ba00ebeeacf173901c5bd321d3309712f1","observation_id":"98ac0450-8c64-4734-9a48-1ffd666d766c","resolution":{"observed_at":"2026-08-07T19:57:04.299593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.305263Z","title":"Mnl-bandit: A dynamic learning approach to assortment selection","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.305263Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:ec09129517f159fc711874782fea3fd103b63c8bc1e0c1be35a3e7e8aa7a08d3","observation_id":"029518b4-661e-4cc4-beb5-e994341b99a1","resolution":{"observed_at":"2026-08-07T19:57:04.305263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.939689Z","title":"and Orabona, F","venue":null,"work_id":"ecab1a33-59fa-42ef-a2d6-b83c804edc0d","year":2020},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.310417Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:66674d7634cc2a94e4360990b39ee0cf6bddcbbd8fb10f334bc2ad8e3ec0ab37","observation_id":"71714843-40a4-4df9-897f-2b9ba0e877d5","resolution":{"observed_at":"2026-08-07T19:57:04.944571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.923611Z","title":"Dynamic assortment optimization with changing contextual information","venue":null,"work_id":"7a92425b-0afc-4f22-bdbf-6a0660705b1c","year":2020},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.315344Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:ef0deb52d61c5667e11a67236bcfe402ea02397f4d92add13279e432011f6046","observation_id":"c221067a-8140-476a-b020-4a9cc358103b","resolution":{"observed_at":"2026-08-07T19:57:04.928699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20165","last_updated":"2024-10-31T05:14:55Z","snapshot_observed_at":"2026-08-08T15:12:07.761185Z","submitted_at":"2024-05-30T15:39:19Z","title":"Randomized Exploration for Reinforcement Learning with Multinomial Logistic Function Approximation","version":2},"cited_work":{"arxiv_id":"2405.20165","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.20165","snapshot_observed_at":"2026-08-07T19:57:04.607682Z","title":"Randomized Exploration for Reinforcement Learning with Multinomial Logistic Function Approximation","venue":"stat.ML","work_id":"67e37360-bc07-49df-8b3e-0dd7ae6b6a16","year":2024},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.321031Z"},"links":{"cited_paper":"/paper/2405.20165","citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:9f562214435cd047fce20b8f28e686ae4693fe99d985a2b6aca435d61681676c","observation_id":"a4a86fdf-f7d1-4fd8-b13c-76432e207683","resolution":{"observed_at":"2026-08-07T19:57:04.613603Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.907452Z","title":"M., Gallego, G., and Topaloglu, H","venue":null,"work_id":"864d8427-9aea-4ea8-971f-4b5142e5cfc7","year":2014},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.326354Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:9f4b6c660c3a6ce3a2b9cc862acd50348a45a53ad11557f99d74ca5db28217d5","observation_id":"2ef9a6c0-dde0-4f3d-9dfa-1c1592e11769","resolution":{"observed_at":"2026-08-07T19:57:04.912282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.891074Z","title":"On the performance of thompson sampling on logistic bandits","venue":null,"work_id":"505d3e8e-0e1e-4875-a6fd-86f59e425d58","year":2019},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.331049Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:9d97e477d6db0d36f5deaa2c4466240778cb03ac9226fabb14e9a5687b161bce","observation_id":"395b0f73-9a7c-45c4-86e1-eeae296055fd","resolution":{"observed_at":"2026-08-07T19:57:04.896306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.335944Z","title":"Improved optimistic algorithms for logistic bandits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.335944Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:93a91ab7d95c39c89e1ecd6e6f2d95b342bb32d8c721dfb5e63211b98907ae94","observation_id":"33c44dad-05ae-441a-a5f4-e05eee9c740a","resolution":{"observed_at":"2026-08-07T19:57:04.335944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.340812Z","title":"Jointly efficient and optimal algorithms for logistic bandits","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.340812Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:f90b8018a15a31311583f7755b296a37f2de79decc5d9b6af4fd6e1f3db6fb05","observation_id":"354e32f4-8d52-47f0-8da2-b10453c109c5","resolution":{"observed_at":"2026-08-07T19:57:04.340812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.854351Z","title":"J., Kale, S., Luo, H., Mohri, M., and Sridharan, K","venue":null,"work_id":"fa4bdf81-3e89-46bc-b59f-5c26fc742dd1","year":2018},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.345841Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:5c062edd55f5738219d56fe171c4c8a0c54a5761c34661e6f483634790936060","observation_id":"562a6fc7-a9f1-4907-ae95-e98de2813233","resolution":{"observed_at":"2026-08-07T19:57:04.859444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.350660Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.350660Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:d4277dba75a073fd5bf81f38d45900e84d6715f24eaf5c5f002dc98f1f18a49d","observation_id":"a57f2435-0449-459b-be8f-6ed5c9cfcdfb","resolution":{"observed_at":"2026-08-07T19:57:04.350660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.13540","last_updated":"2024-11-17T09:17:02Z","snapshot_observed_at":"2026-07-06T14:35:18.395420Z","submitted_at":"2022-12-27T16:25:09Z","title":"Model-Based Reinforcement Learning with Multinomial Logistic Function Approximation","version":2},"cited_work":{"arxiv_id":"2212.13540","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.13540","snapshot_observed_at":"2026-08-07T19:57:04.583152Z","title":"Model-Based Reinforcement Learning with Multinomial Logistic Function Approximation","venue":"stat.ML","work_id":"e506d7e6-8ea1-40f2-ac32-d63f04b62e26","year":2022},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.355613Z"},"links":{"cited_paper":"/paper/2212.13540","citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:48584794c8258ecb39db47b95dea024ec11b0970be6a4b5beb433f5b810d172b","observation_id":"886bccc9-1dbf-444a-b1c8-8ed5779ce9bf","resolution":{"observed_at":"2026-08-07T19:57:04.588808Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.827582Z","title":"Mixability made efficient: Fast online multiclass logistic regression","venue":null,"work_id":"99315319-d2b1-4591-9a7e-aa63a0600e9f","year":2021},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.360904Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:b5ecf7370f0846249fb716d9cab59063886cb24de37643b7082d1040583858aa","observation_id":"9456c4c2-280c-4de9-be63-40ff74cafd58","resolution":{"observed_at":"2026-08-07T19:57:04.832839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.365896Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.365896Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:076df55021c1ec418d4a621251867cf35e9a640b25da54724d32c9812c0bd443","observation_id":"daaca871-7c85-402a-b064-bd77003f04a1","resolution":{"observed_at":"2026-08-07T19:57:04.365896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.800975Z","title":"Improved regret analysis for variance-adaptive linear bandits and horizon-free linear mixture mdps","venue":null,"work_id":"1d4138a5-6241-4d3d-b33c-c0642cc2b891","year":2022},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.371159Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:92d243a0c4bcf7d7a2480713ffb81ac407e6aeb5a5a47a60404d5ad7a041edb5","observation_id":"e032c028-f5fd-4599-b6a4-2f50dadb6237","resolution":{"observed_at":"2026-08-07T19:57:04.806395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.376270Z","title":"and Oh, M.-h","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.376270Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:55e836ee549d917d36645164042eb1d4f25f99dc1492c7af9ee22a433cbfe07d","observation_id":"9357f74d-f942-4fa8-bfc8-5245d60d0d14","resolution":{"observed_at":"2026-08-07T19:57:04.376270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10158","last_updated":"2025-06-05T01:30:34Z","snapshot_observed_at":"2026-08-08T15:11:41.783969Z","submitted_at":"2025-02-14T13:37:02Z","title":"Combinatorial Reinforcement Learning with Preference Feedback","version":3},"cited_work":{"arxiv_id":"2502.10158","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.10158","snapshot_observed_at":"2026-08-07T19:57:04.556666Z","title":"Combinatorial Reinforcement Learning with Preference Feedback","venue":"stat.ML","work_id":"b4f618f1-0124-4198-8cb1-1ba2ddfa8fa5","year":2025},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.381612Z"},"links":{"cited_paper":"/paper/2502.10158","citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:c24db4beb0a5fa67244873ca95978649406ddc3a888eebd216c43f12ad31a614","observation_id":"43b8d225-c795-465e-b2a8-95d9a7baee25","resolution":{"observed_at":"2026-08-07T19:57:04.564210Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.773604Z","title":"Improved regret bounds of (multinomial) logistic bandits via regret-to-confidence-set conversion","venue":null,"work_id":"58233e4b-6763-474c-befb-035fa3312050","year":2024},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.387163Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:b716c6a10aac9f7d647a7ce282ae909b9819f2e2bd32e13c818b53ee189539f9","observation_id":"18e02381-33bd-4e77-a525-fdd154b8bde5","resolution":{"observed_at":"2026-08-07T19:57:04.779086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13977","last_updated":"2025-01-15T09:25:02Z","snapshot_observed_at":"2026-08-06T04:07:50.783545Z","submitted_at":"2024-07-19T02:06:08Z","title":"A Unified Confidence Sequence for Generalized Linear Models, with Applications to Bandits","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13977","snapshot_observed_at":"2026-08-07T19:57:04.392443Z","title":"A unified confidence sequence for generalized linear models, with applications to bandits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.392443Z"},"links":{"cited_paper":"/paper/2407.13977","citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:0016b0db29e54e955b5dc1d38e4ed57d78f1e3724ae9eb36a3fc7004440da687","observation_id":"6e692353-883d-45f9-bdb6-35fc744601eb","resolution":{"observed_at":"2026-08-07T19:57:04.392443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17061","last_updated":"2025-01-16T14:45:52Z","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:31:54Z","title":"Provably Efficient Reinforcement Learning with Multinomial Logit Function Approximation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17061","snapshot_observed_at":"2026-08-07T19:57:04.398028Z","title":"Provably efficient reinforcement learning with multinomial logit function approximation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.398028Z"},"links":{"cited_paper":"/paper/2405.17061","citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:c618414758067692684464582795a28dee124837afdb554d5ff4f8d916dbba7b","observation_id":"6907349d-54b4-4b13-9520-78832b7496a8","resolution":{"observed_at":"2026-08-07T19:57:04.398028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.403937Z","title":"Modelling the choice of residential location","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.403937Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:252c4e72865d6cabe1505db3c0820696b6d3b32b9ca3749527fbc1cd5137e07e","observation_id":"43fdf7f1-f54e-42ab-b232-3be17b1e7154","resolution":{"observed_at":"2026-08-07T19:57:04.403937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.409176Z","title":"and Iyengar, G","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.409176Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:1affe8b9a7384dba684eb8994629258358a6066d76562f8e1260b756d61233d9","observation_id":"f90ff801-3b45-4b0e-b744-de5e794a1531","resolution":{"observed_at":"2026-08-07T19:57:04.409176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.414503Z","title":"and Iyengar, G","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.414503Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:b6445f37337cc931ff73b92c229394c5ff908798f3bdf7afd462abd390ce8420","observation_id":"ce64861b-0a2d-4345-8625-b35d9cfba7e4","resolution":{"observed_at":"2026-08-07T19:57:04.414503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.725849Z","title":"Multinomial logit bandit with linear utility functions","venue":null,"work_id":"e0732cc8-8636-42fe-9b94-e6286d0578ee","year":2018},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.419185Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:6b9af4330f05225c3cf0a92fbb91e06528b984640f0a983a5e4a72340bf7b567","observation_id":"cacdfdb8-e4d8-476f-af53-984628a6ae22","resolution":{"observed_at":"2026-08-07T19:57:04.731088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13633","last_updated":"2024-10-14T00:37:51Z","snapshot_observed_at":"2026-07-06T18:33:45.816337Z","submitted_at":"2024-06-19T15:29:14Z","title":"Infinite-Horizon Reinforcement Learning with Multinomial Logistic Function Approximation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13633","snapshot_observed_at":"2026-08-07T19:57:04.424269Z","title":"Infinite-horizon reinforcement learning with multinomial logistic function approximation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.424269Z"},"links":{"cited_paper":"/paper/2406.13633","citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:d8c15738e5b3be8316facaf0430de0b420b4703563dc2f1ea5d8486e0b06570a","observation_id":"7cc01e79-fa64-4674-89d6-f96ff50575af","resolution":{"observed_at":"2026-08-07T19:57:04.424269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.429722Z","title":"and Goyal, V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.429722Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:c03dbb2605ac284c23dcbb0166c4000a1610ff1501a136c8fcd0620eb7cd0e82","observation_id":"95dcf5be-b2c3-4736-b160-c5985e864aa0","resolution":{"observed_at":"2026-08-07T19:57:04.429722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.434964Z","title":"M., and Shmoys, D","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.434964Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:cf548c036aea8133b7ce51b776fb82b7a832e8e2a08bfd8514df7b0e3fc74d32","observation_id":"e749d384-554f-441f-8295-cb24a4cef756","resolution":{"observed_at":"2026-08-07T19:57:04.434964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.439756Z","title":"and Zeevi, A","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.439756Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:e6f9e8add06acc4558a817a532892474f0b7b6320c9ac4f5c17421a6fbc39ed3","observation_id":"8d26eda6-17e5-48ba-b171-46fe35581a03","resolution":{"observed_at":"2026-08-07T19:57:04.439756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.676973Z","title":"Generalized linear bandits with limited adaptivity","venue":null,"work_id":"257450af-64d4-4c13-bcfe-9ed12c80bd9f","year":2024},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.444534Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:3d4ccdd2d8005261ffaa1995fe5b7fe3fddafa940b726c53524b468ecbde96ec","observation_id":"bf743657-9b58-40b0-949d-39b02fbf8053","resolution":{"observed_at":"2026-08-07T19:57:04.682395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.449417Z","title":"Composite convex minimization involving self-concordant-like cost functions","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.449417Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:11533e52bd07e8af97492732f52b139a7aeeccef63a626bf058a462d39837e04","observation_id":"6e004508-af96-4b42-b2ea-9fc93e18cb04","resolution":{"observed_at":"2026-08-07T19:57:04.449417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.648441Z","title":"Etude critique de la notion de collectif, volume 3","venue":null,"work_id":"fed22571-ba1e-47f0-831f-21099cbc0f4b","year":1939},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.454020Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:80ece270601038f9875aa16b04764bd44c8633845fb1785adfa1f81ed05fe5db","observation_id":"02684f4a-0b7f-41dd-ad48-c6d96b2fcf12","resolution":{"observed_at":"2026-08-07T19:57:04.654657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.458882Z","title":"and Sugiyama, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.458882Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:6ec7b06b5511c856bb8025bb7401957c03e2f3fc772bdf90273589cbc24dc142","observation_id":"4686b175-9c22-4bef-b573-8a27c48f7da9","resolution":{"observed_at":"2026-08-07T19:57:04.458882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:57:04.463584Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits","version":5},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T19:57:04.463584Z"},"links":{"citing_paper":"/paper/2502.10020"},"observation_digest":"sha256:10244679a5101ff6aa9e083af02414ca0aa8b93695ccd7e314c15d9cf4d1c74a","observation_id":"94e40ae9-11f1-443b-b9e2-c6f125733dd6","resolution":{"observed_at":"2026-08-07T19:57:04.463584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.10020","last_updated":"2025-06-16T13:10:36Z","latest_version":5,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-08T15:11:39.084049Z","submitted_at":"2025-02-14T09:01:12Z","title":"Improved Online Confidence Bounds for Multinomial Logistic Bandits"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":3,"verified_fuzzy":11},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 4 inbound Pith citation observations for arXiv:2502.10020."}