{"as_of":"2026-08-18T20:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8937bcdf05523f59c1f900fc18b6822b763c363009176f21d27b817d6dadfe45","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T01:11:14.046897Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T20:03:56.218493Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-08-09T16:44:30.874716Z","title":"Neural dueling bandits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01085","last_updated":"2025-06-03T03:29:00Z","snapshot_observed_at":"2026-08-14T01:05:24.167135Z","submitted_at":"2025-02-03T05:56:22Z","title":"Federated Linear Dueling Bandits","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T16:44:30.874716Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2502.01085"},"observation_digest":"sha256:6920bc145432fa5df294e1e11cbee365ece1c517431dd7219490f5df6400d6e7","observation_id":"61960fac-8467-445a-a0f6-c5e3c7642e02","resolution":{"observed_at":"2026-08-09T16:44:30.874716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-08-09T16:35:28.432870Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-18T17:16:03.011286Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.432870Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:401c11fc23931fa649100e3caf96016f441e1bf04c5459d21038afa18a663f6d","observation_id":"60bec8d0-2692-46cf-91bb-7a64c7da2c42","resolution":{"observed_at":"2026-08-09T16:35:28.432870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-08-09T13:34:48.827791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02079","last_updated":"2025-02-04T07:55:41Z","snapshot_observed_at":"2026-08-17T20:48:25.362063Z","submitted_at":"2025-02-04T07:55:41Z","title":"Online Clustering of Dueling Bandits","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T13:34:48.827791Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2502.02079"},"observation_digest":"sha256:7fd1cc60fb819a8a4fa6205a0b3c21403450a59359ee65bcb6d885fd8a36b6d3","observation_id":"4708949a-e034-4a88-8127-e818ca31be98","resolution":{"observed_at":"2026-08-09T13:34:48.827791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-08-16T01:11:14.046897Z","title":"Neural dueling bandits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02069","last_updated":"2026-05-28T15:37:14Z","snapshot_observed_at":"2026-08-17T12:11:32.432498Z","submitted_at":"2025-05-04T11:23:16Z","title":"Neural Logistic Bandits","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T01:11:14.046897Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2505.02069"},"observation_digest":"sha256:70f76b5d9b543554de0accba0d1b855b7d28d2a2ee59b097ce40332396a0b13d","observation_id":"3f5e055d-b7e8-4357-b5b1-ee05921e900f","resolution":{"observed_at":"2026-08-16T01:11:14.046897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":"2407.17112","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-06-29T20:03:56.218493Z","title":"Neural dueling bandits","venue":null,"work_id":"0a24468d-d86a-4170-b74b-8fbcfaa9775d","year":2024},"citing_paper":{"arxiv_id":"2506.01250","last_updated":"2026-06-03T04:29:50Z","snapshot_observed_at":"2026-08-13T20:28:50.094674Z","submitted_at":"2025-06-02T01:58:48Z","title":"Neural Variance-aware Dueling Bandits with Deep Representation and Shallow Exploration","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T11:29:47.911870Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2506.01250"},"observation_digest":"sha256:411819556973aa8f007ae5efb42f1bb73538073ef30e2ce56218551b93f6fe65","observation_id":"7b0db379-f4e4-4864-82ce-70811f772de4","resolution":{"observed_at":"2026-05-19T11:32:17.609629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-08-07T11:58:37.208959Z","title":"Neural dueling bandits, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01250","last_updated":"2026-06-03T04:29:50Z","snapshot_observed_at":"2026-08-13T20:28:50.094674Z","submitted_at":"2025-06-02T01:58:48Z","title":"Neural Variance-aware Dueling Bandits with Deep Representation and Shallow Exploration","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:58:37.208959Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2506.01250"},"observation_digest":"sha256:f412537dde5e29694775290edce2f550de5b4db6a026e2761a90f1d86d97dd0f","observation_id":"3b9b1614-b01d-416c-831e-b8682d912326","resolution":{"observed_at":"2026-08-07T11:58:37.208959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-08-04T13:52:12.555950Z","title":"Neural dueling bandits: Preference-based optimization with human feedback.arXiv preprint arXiv:2407.17112,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24696","last_updated":"2026-05-30T14:42:04Z","snapshot_observed_at":"2026-08-18T11:00:29.173555Z","submitted_at":"2025-09-29T12:28:23Z","title":"T-POP: Test-Time Personalization with Online Preference Feedback","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T13:52:12.555950Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2509.24696"},"observation_digest":"sha256:36eae0d7b685de43cbac18010a81d88f5600672e219a70d3213f389d20c45ebb","observation_id":"c3eb1e73-916d-4ec5-992c-9469a9e8c829","resolution":{"observed_at":"2026-08-04T13:52:12.555950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":"2407.17112","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-06-29T20:03:56.218493Z","title":"Neural dueling bandits","venue":null,"work_id":"0a24468d-d86a-4170-b74b-8fbcfaa9775d","year":2024},"citing_paper":{"arxiv_id":"2605.26554","last_updated":"2026-05-26T05:07:25Z","snapshot_observed_at":"2026-08-15T11:20:20.720751Z","submitted_at":"2026-05-26T05:07:25Z","title":"Linear and Neural Dueling Bandits with Delayed Feedback","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-29T20:02:37.326350Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2605.26554"},"observation_digest":"sha256:4e9021f9e136e6bc5e89c308bd610504bdaca37a49f98b0e7b6278f21bdeece3","observation_id":"48511a89-2350-431d-aceb-b7f2ed0b45c8","resolution":{"observed_at":"2026-06-29T20:03:56.219946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.17112/citation-record","integrity":"/paper/2407.17112/integrity","json":"/paper/2407.17112/citation-record.json","paper":"/paper/2407.17112"},"outbound":[],"paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T13:31:30.517519Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2407.17112."}