{"as_of":"2026-08-09T23:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8316954aa3c228057f0ba9bfd672d4dc72a7ea1c0171907cee1a59c29d110b9e","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:54:13.607657Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T16:49:14.243931Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T01:07:30.215801Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"cited_work":{"arxiv_id":"2509.03672","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.03672","snapshot_observed_at":"2026-07-03T01:07:30.215801Z","title":"https://arxiv.org/ abs/2509.03672","venue":null,"work_id":"527cb55e-43cf-472c-85c4-5635f743acbc","year":2025},"citing_paper":{"arxiv_id":"2606.09038","last_updated":"2026-06-08T05:10:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-08T05:10:05Z","title":"Personalization Meets Safety:Mechanisms,Risks,and Mitigations in Personalized LLMs","version":1},"reference_index":171,"source":"pdf_text","source_observed_at":"2026-06-27T16:49:14.243931Z"},"links":{"cited_paper":"/paper/2509.03672","citing_paper":"/paper/2606.09038"},"observation_digest":"sha256:6f6e43f56144226629e610de56bb745bd1086c93476eb68984a29d7929503d06","observation_id":"d01e6178-4e4e-4035-9ad6-0c8a4e3310de","resolution":{"observed_at":"2026-07-03T01:07:30.217449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.03672/citation-record","integrity":"/paper/2509.03672/integrity","json":"/paper/2509.03672/citation-record.json","paper":"/paper/2509.03672"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-05T10:54:10.716053Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.716053Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:8da95a52bda4aeb74d1cc6e20d52aec0dc017c8a50ef8ffd4ec789636f50678d","observation_id":"fe8cde69-a40f-4ab0-9ee2-9c163d20786b","resolution":{"observed_at":"2026-08-05T10:54:10.716053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"quant-ph/0610146","last_updated":"2006-10-18T13:49:39Z","snapshot_observed_at":"2026-08-06T00:46:28.844372Z","submitted_at":"2006-10-18T13:49:39Z","title":"A Sharp Fannes-type Inequality for the von Neumann Entropy","version":1},"cited_work":{"arxiv_id":"quant-ph/0610146","doi":null,"metadata_source":"pith","pith_arxiv_id":"quant-ph/0610146","snapshot_observed_at":"2026-08-05T10:54:14.118658Z","title":"A Sharp Fannes-type Inequality for the von Neumann Entropy","venue":"quant-ph","work_id":"fa9b8dbf-9ebe-4739-8a76-0856a3b36b0c","year":2006},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.769694Z"},"links":{"cited_paper":"/paper/quant-ph/0610146","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:c9eb681fcc23b96ac6918c688b76c6592cea9d643a392433cda058390d86e0d7","observation_id":"de8ce66d-7c79-458c-a04b-ec831e7f9bdb","resolution":{"observed_at":"2026-08-05T10:54:14.125679Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T10:54:10.832231Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.832231Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:032c5d7772c51c50a8888aa3f64cf29b68fb060d1d1b20e07bf56642a815d093","observation_id":"98653cfa-3c35-42ff-94b9-eda507bd7ace","resolution":{"observed_at":"2026-08-05T10:54:10.832231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:10.891723Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.891723Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:ee205c38552a5cebe40274c5b5c8b520e0ef313613f99ef12e4cf9fead931481","observation_id":"e687d5f9-1a48-4b56-acfc-308db9130456","resolution":{"observed_at":"2026-08-05T10:54:10.891723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15217","last_updated":"2023-09-11T17:25:24Z","snapshot_observed_at":"2026-08-03T19:11:09.671782Z","submitted_at":"2023-07-27T22:29:25Z","title":"Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15217","snapshot_observed_at":"2026-08-05T10:54:10.974544Z","title":"Open problems and fundamental limitations of reinforcement learning from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.974544Z"},"links":{"cited_paper":"/paper/2307.15217","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:c17aa655bb3b8770ab83ca690363d031008440015dcd1324d6fdd83ee028b0a0","observation_id":"97bb6238-1d2c-4042-b3e8-2ea3e4dddebe","resolution":{"observed_at":"2026-08-05T10:54:10.974544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19320","last_updated":"2025-02-19T00:51:58Z","snapshot_observed_at":"2026-07-06T18:22:10.094519Z","submitted_at":"2024-05-29T17:51:42Z","title":"Value-Incentivized Preference Optimization: A Unified Approach to Online and Offline RLHF","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19320","snapshot_observed_at":"2026-08-05T10:54:11.055317Z","title":"Value-incentivized preference optimization: A unified approach to online and offline rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.055317Z"},"links":{"cited_paper":"/paper/2405.19320","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:da2177b4fdca0e3c2f0e8929dabd7f1f7561b330696d7ce056e962dd1c439a4e","observation_id":"d5241516-3b74-46d1-9351-296611749a36","resolution":{"observed_at":"2026-08-05T10:54:11.055317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08925","last_updated":"2024-12-26T00:15:20Z","snapshot_observed_at":"2026-08-09T15:45:13.646720Z","submitted_at":"2024-02-14T03:56:27Z","title":"MaxMin-RLHF: Alignment with Diverse Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08925","snapshot_observed_at":"2026-08-05T10:54:11.144244Z","title":"Maxmin- RLHF : Alignment with diverse human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.144244Z"},"links":{"cited_paper":"/paper/2402.08925","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:c8f9b5207b82711bb7604dd58c1f190d5aaeaa3c226cf1764b2e4af7bb2ee3aa","observation_id":"1fb46bd4-3130-4a4c-8d0c-9357b37ad186","resolution":{"observed_at":"2026-08-05T10:54:11.144244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08469","last_updated":"2024-06-12T17:54:54Z","snapshot_observed_at":"2026-08-07T19:56:45.521787Z","submitted_at":"2024-06-12T17:54:54Z","title":"PAL: Pluralistic Alignment Framework for Learning from Heterogeneous Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08469","snapshot_observed_at":"2026-08-05T10:54:11.230380Z","title":"PAL : Pluralistic alignment framework for learning from heterogeneous preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.230380Z"},"links":{"cited_paper":"/paper/2406.08469","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:e4f1a350b490d4e5bc838b053a1ce47aae23006b75abb70364c6b2688a9a3b2d","observation_id":"f4181020-b7af-400b-acc7-19cf002d6b28","resolution":{"observed_at":"2026-08-05T10:54:11.230380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.334387Z","title":"The alignment problem: How can machines learn human values? Atlantic Books, 2021","venue":null,"work_id":"f13b1601-a64b-4ce7-8e33-c3b4ef048cbc","year":2021},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.305666Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:b4d10bbeda6c57defc5cee61c790c12d5dc8e260cb1683dfeae10e730aa2c6b8","observation_id":"60305593-17c6-4416-83df-aa8d0c54f42d","resolution":{"observed_at":"2026-08-05T10:54:14.339079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T10:54:11.358214Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.358214Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:afabfb0d1683c2ab486d9f81d3bddef333c5c0bf79f1ae3865f96bffda98d351","observation_id":"936afcaa-c91e-4cd2-89f3-fb19b297db57","resolution":{"observed_at":"2026-08-05T10:54:11.358214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:11.424298Z","title":"Active preference optimization for sample efficient rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.424298Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:dddd4d7a84a228c9d43fc1d6e350b90f0d29f887442f73377a83821798ab4348","observation_id":"41632b7a-2b4f-4813-bf37-6d0ee4a79b09","resolution":{"observed_at":"2026-08-05T10:54:11.424298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:11.466795Z","title":"When personalization meets reality: A multi-faceted analysis of personalized preference learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.466795Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:012c5a640a785332c125e928620e83c2172b023a5566ad2427d45662460367a3","observation_id":"88ca93d6-092d-48ca-af65-522c391164de","resolution":{"observed_at":"2026-08-05T10:54:11.466795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07453","last_updated":"2025-03-13T23:15:55Z","snapshot_observed_at":"2026-08-07T17:16:22.945358Z","submitted_at":"2025-03-10T15:31:42Z","title":"Is a Good Foundation Necessary for Efficient Reinforcement Learning? The Computational Role of the Base Model in Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07453","snapshot_observed_at":"2026-08-05T10:54:11.555391Z","title":"Is a good foundation necessary for efficient reinforcement learning? the computational role of the base model in exploration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.555391Z"},"links":{"cited_paper":"/paper/2503.07453","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:79ced30c770c1227d133ba2464cb55972e14e8a3bb5317cfcc3c60c05e4b8f25","observation_id":"1accefff-7cf8-4e75-a659-1d2262aba6fc","resolution":{"observed_at":"2026-08-05T10:54:11.555391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11564","last_updated":"2023-10-17T20:22:13Z","snapshot_observed_at":"2026-07-06T16:34:42.650324Z","submitted_at":"2023-10-17T20:22:13Z","title":"Personalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11564","snapshot_observed_at":"2026-08-05T10:54:11.639883Z","title":"Personalized soups: Personalized large language model alignment via post-hoc parameter merging","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.639883Z"},"links":{"cited_paper":"/paper/2310.11564","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:79e9739dd0dc5e6e21f057d461ed2f9800b8fabf08cad037eb16a4fb53e2180e","observation_id":"678c3fde-147b-4386-a1d5-01868278dfe5","resolution":{"observed_at":"2026-08-05T10:54:11.639883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.310326Z","title":"Provably feedback-efficient reinforcement learning via active reward learning","venue":null,"work_id":"c65490f1-7291-4404-8ecf-8dca24f3ecef","year":2022},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.724453Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:460bd9df06a1c38d75894f3bfbe31861c220d8e4e740d8e1372eb7e048a3ec5f","observation_id":"4b01892f-6150-4dd1-aecd-dc5de55d79c3","resolution":{"observed_at":"2026-08-05T10:54:14.314729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:11.778287Z","title":"Bandit algorithms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.778287Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:60a05b36960da8f6b7ca1c59c1f67f02b1e39fc124a48338ce9e294e0c1e6edd","observation_id":"9e840360-9f7b-424c-835f-e8e8a47a2a0b","resolution":{"observed_at":"2026-08-05T10:54:11.778287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02205","last_updated":"2025-02-09T17:13:51Z","snapshot_observed_at":"2026-07-06T19:26:49.672415Z","submitted_at":"2024-10-03T04:34:04Z","title":"Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02205","snapshot_observed_at":"2026-08-05T10:54:11.835948Z","title":"Aligning with logic: Measuring, evaluating and improving logical consistency in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.835948Z"},"links":{"cited_paper":"/paper/2410.02205","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:0e083d7dceb31b44dc9f4ec3230ec2195e5439c2a3a9cc1cc5b8f4f9fe59fd89","observation_id":"68bd6346-be17-4508-aee6-fc743a492faa","resolution":{"observed_at":"2026-08-05T10:54:11.835948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.284395Z","title":"Learning word vectors for sentiment analysis","venue":null,"work_id":"40020feb-4f3d-4997-96af-6457e0294256","year":2011},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.925172Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:90e6b63bad46bbef9bdd71f30a8efab8346d66c82c17773a83b0d8b006e6ba53","observation_id":"ddb95464-f354-4e29-985d-ce7d3544a8a2","resolution":{"observed_at":"2026-08-05T10:54:14.288750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:11.989754Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.989754Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:a9233cccbef70b3dc994c683d79a27efa644dca988682c10bb868a1634cfb82c","observation_id":"6de299e3-5109-4788-9121-e654899f0bed","resolution":{"observed_at":"2026-08-05T10:54:11.989754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.258158Z","title":"Iterative reasoning preference optimization","venue":null,"work_id":"0004dadf-fca8-483e-aaf1-ce80b6bc7ca2","year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.079907Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:65652fc378afa15c2177605c54c8453a0fa1edf6f86c9ae76a77e32fe47fbf56","observation_id":"20c57c66-534a-42b9-a12b-fb52ed52ceae","resolution":{"observed_at":"2026-08-05T10:54:14.263709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10075","last_updated":"2024-08-19T15:18:30Z","snapshot_observed_at":"2026-08-09T20:26:15.885759Z","submitted_at":"2024-08-19T15:18:30Z","title":"Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10075","snapshot_observed_at":"2026-08-05T10:54:12.137540Z","title":"Personalizing reinforcement learning from human feedback with variational preference learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.137540Z"},"links":{"cited_paper":"/paper/2408.10075","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:6db18e0ee4e45c5cc5415f057a005b36be9e36172dd2b94bf616dac3e6212a9f","observation_id":"170584b6-cd83-4933-b97a-d3ddcbacea7a","resolution":{"observed_at":"2026-08-05T10:54:12.137540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:12.237589Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.237589Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:9cdc90dde561e93c5c06873f77f692f033fd54d57cf98462eba94900fb51c438","observation_id":"0d3e55d7-8115-4545-83da-7e1eaffe14c7","resolution":{"observed_at":"2026-08-05T10:54:12.237589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.230674Z","title":"Group robust preference optimization in reward-free rlhf","venue":null,"work_id":"6e45c072-8982-465c-b33f-09936d0907d7","year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.320047Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:553e29f9a43f271d3b30cf584cb01c634f84abed95d82257ded2823a9b88316b","observation_id":"ca89941e-85a1-443f-afb1-22990b46f596","resolution":{"observed_at":"2026-08-05T10:54:14.235770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.214829Z","title":"Dueling rl: Reinforcement learning with trajectory preferences","venue":null,"work_id":"90a15a20-5ab5-4685-b885-7864bb87a084","year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.412731Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:58505fa3e5c7a99dc1db237558a2fd357f0e6fbe4c1f0889c61643a51b5288d7","observation_id":"3b9ce4ec-c2af-4127-ae71-2169cf9c2400","resolution":{"observed_at":"2026-08-05T10:54:14.219234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.199287Z","title":"Whose opinions do language models reflect? In International Conference on Machine Learning, pages 29971--30004","venue":null,"work_id":"03f7f36f-b2b9-4a1f-a353-577f9111bc5a","year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.495223Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:8e605de18fe99fd47da0b258a99a4ad6143670d74f8434905297b6701258bf68","observation_id":"ef35e711-f3b8-44ef-951b-25f36f72e3b4","resolution":{"observed_at":"2026-08-05T10:54:14.204135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T10:54:12.534185Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.534185Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:fe63bb3becbfd23df31c17f5f1fdc8790a09e25bc994ad727d09cefd9879628a","observation_id":"fa21e778-d9e4-4fdd-9cc0-0aafdad75656","resolution":{"observed_at":"2026-08-05T10:54:12.534185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:12.626549Z","title":"Collective Choice and Social Welfare: An Expanded Edition","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.626549Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:e05f8c7336d8c954b721323a2717fc53d87984366f4feb268df52fdf9b4d558d","observation_id":"452cded4-fff2-4aa3-98aa-e5c967bb6dc6","resolution":{"observed_at":"2026-08-05T10:54:12.626549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T10:54:12.794995Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.794995Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:cd5d6cee2c3ddc6a473ae67cb959b75b25fecd697cf0032456830ffe246e1a35","observation_id":"ab95073d-b7e5-4df8-95de-abd0a5a34da5","resolution":{"observed_at":"2026-08-05T10:54:12.794995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:12.873574Z","title":"Robust multi-objective controlled decoding of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.873574Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:084bcb2f60ee22ee34ad36d61607f748e79b98266c9909880703c14a10a62b40","observation_id":"7d07935c-e1dc-40c4-8720-48d0455f98e3","resolution":{"observed_at":"2026-08-05T10:54:12.873574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-06T19:18:51.065158Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-05T10:54:12.976902Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.976902Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:347b8164b8cc513ac5e9e9534d58a046cbbde1dc576919d6b3038995464b091f","observation_id":"1e85c555-f779-4e4c-bcd1-16de7045dfa7","resolution":{"observed_at":"2026-08-05T10:54:12.976902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-07-06T15:57:57.167169Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-05T10:54:13.130765Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.130765Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:4250eb5dde1ddb95c037204029324c9a2e869f68c13bf70924adfd87be8fdbb2","observation_id":"57da1d23-91bb-4077-aafa-9c65c0328894","resolution":{"observed_at":"2026-08-05T10:54:13.130765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21046","last_updated":"2024-05-31T17:39:06Z","snapshot_observed_at":"2026-07-31T03:29:04.443362Z","submitted_at":"2024-05-31T17:39:06Z","title":"Exploratory Preference Optimization: Harnessing Implicit Q*-Approximation for Sample-Efficient RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21046","snapshot_observed_at":"2026-08-05T10:54:13.249178Z","title":"Exploratory preference optimization: Harnessing implicit q*-approximation for sample-efficient rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.249178Z"},"links":{"cited_paper":"/paper/2405.21046","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:3684e534db465299efcc476476588ce0eb95d6daa09cacedbf86cf7908789607","observation_id":"456bd312-3c97-43e2-bcc5-7cff9de0513a","resolution":{"observed_at":"2026-08-05T10:54:13.249178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.182719Z","title":"Iterative preference learning from human feedback: Bridging theory and practice for RLHF under KL -constraint","venue":null,"work_id":"60591098-046c-486b-9ed2-c4ed42bdb576","year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.373392Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:a441d34a30a0178cb945add35db014fc3ed94fbfe9c694ad0e3fbf49d2134fd9","observation_id":"50b4bcdc-9e2e-4605-a69f-c186ffb3f573","resolution":{"observed_at":"2026-08-05T10:54:14.188631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.168630Z","title":"Impact of representation learning in linear bandits","venue":null,"work_id":"9f94ba29-db9e-4dc6-ba8f-ea27b9e325fe","year":2020},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.481709Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:183090360d260196f8119f672be3caabdff373dad33372be2de945037e934657","observation_id":"96b151ef-cf89-42e9-823b-18e4492e0c01","resolution":{"observed_at":"2026-08-05T10:54:14.173019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19332","last_updated":"2024-11-05T07:21:18Z","snapshot_observed_at":"2026-07-06T18:22:10.094519Z","submitted_at":"2024-05-29T17:59:07Z","title":"Self-Exploring Language Models: Active Preference Elicitation for Online Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19332","snapshot_observed_at":"2026-08-05T10:54:13.592468Z","title":"Self-exploring language models: Active preference elicitation for online alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.592468Z"},"links":{"cited_paper":"/paper/2405.19332","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:ccaa3707235c02b6702f43a6d7d948dc735eabc011874a3e4532c01c9134b145","observation_id":"243ea628-e798-41c4-acb3-3fda90368e0b","resolution":{"observed_at":"2026-08-05T10:54:13.592468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.153544Z","title":"Principled reinforcement learning with human feedback from pairwise or k-wise comparisons","venue":null,"work_id":"bb1e8d31-07ad-4d81-a49b-591091e19430","year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.607657Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:1e894c72e684dae324d8bf520af262db115a4dbc05e1c2a5313de9df46aa62b5","observation_id":"77f38854-3e60-4eee-9a0c-ac68f7e0abe5","resolution":{"observed_at":"2026-08-05T10:54:14.158270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2509.03672."}