{"as_of":"2026-08-09T09:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:062d50959312cd63be7cb3901270e69ed8037eaf9e29d4f8c67460add7aead35","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:24.396122Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01556/citation-record","integrity":"/paper/2608.01556/integrity","json":"/paper/2608.01556/citation-record.json","paper":"/paper/2608.01556"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T00:14:19.305458Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.305458Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:56b742e53dee340f87445879506b57e9b28e9b1fe5565b727f6aee89326bd587","observation_id":"cf1aef8b-b797-40a8-9455-2a7773913c5c","resolution":{"observed_at":"2026-08-07T00:14:19.305458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T00:14:19.420535Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.420535Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:e72bf6b5ee0037d9954bd28a25a60764596d2a25811fa5fbc6257dfadbcc3636","observation_id":"fc26ea47-8f9e-4aa8-aa04-341129c2f729","resolution":{"observed_at":"2026-08-07T00:14:19.420535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:33.598112Z","title":null,"venue":null,"work_id":"be7195fb-81b2-42eb-ac79-c52a175bd7ca","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.484960Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:fa6f3dd1bedee650af485de416fb13e9c3ecb8ba9ba088a53e2a675433d607a9","observation_id":"3c045e10-ed19-42c8-ab96-5786153c51bc","resolution":{"observed_at":"2026-08-07T00:14:33.661882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:33.410411Z","title":null,"venue":null,"work_id":"ff9955e5-d16d-41ec-8377-2eeba67c8acd","year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.572097Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:4fe4b78b69b8fbc07cfa78a2d0ccc98e0c0b1745795bd3870e092cf0a63719d8","observation_id":"5ef32673-e7ed-4f87-9d25-02cb03312aae","resolution":{"observed_at":"2026-08-07T00:14:33.496567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:33.195566Z","title":null,"venue":null,"work_id":"b036eeca-813b-40c8-970c-511e174bd121","year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.646153Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:f41b6f0ddb123ffea7a1d4321e55fbfbd5aea5ed399466c70400e2030e6dc0e5","observation_id":"4ef74a50-59e9-4f21-89e9-615ae3e334aa","resolution":{"observed_at":"2026-08-07T00:14:33.272821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:33.028518Z","title":null,"venue":null,"work_id":"d59ff8fc-d35d-47b2-85a4-8c5812ca2576","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.766575Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:8b1bd1f463724f8dabe570dc92a30eddb42daf7a5fddfd6c0e598bd45493b6b1","observation_id":"736d5350-a397-4a15-8dfe-8ba0c79dbbf4","resolution":{"observed_at":"2026-08-07T00:14:33.093799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.700727Z","title":null,"venue":null,"work_id":"a8be796c-a5c6-4167-9843-1dcce7383fa9","year":2019},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.923314Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:80775e537837393dc441409bc357661e5d7c651d9442a3c29bb957ba69014ea5","observation_id":"72e99b7f-9f38-41fd-8376-342c13b8b15c","resolution":{"observed_at":"2026-08-07T00:14:32.782221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.484615Z","title":null,"venue":null,"work_id":"00c26ed7-c09c-4650-ac41-ee9fbdf20fb9","year":1977},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.000449Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:eddda097e40d7597c786498d53d6b3ad00f18961d9ad70c28deeb935e4163f9b","observation_id":"0bac03e2-a3b5-4c6a-b1e6-c87eaa5f9378","resolution":{"observed_at":"2026-08-07T00:14:32.597636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.298363Z","title":"Dinh, Nguyen H","venue":null,"work_id":"2ac1ae34-0af9-467b-a2b0-8051ffa2f606","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.094945Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:7a2b8527ec7933c3fcc55efba3f6e1cc0badf295789ae72f13699fdd17b24f77","observation_id":"4b13ea09-0741-408a-8647-629317b8fc87","resolution":{"observed_at":"2026-08-07T00:14:32.376593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.195400Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.195400Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:95db3f37dff654c71ed99e77e872e21baa3794ccfbc2cac379d9dcda3634470c","observation_id":"9a3d4a59-c960-4513-9bf5-64caa8615a3c","resolution":{"observed_at":"2026-08-07T00:14:20.195400Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.110790Z","title":null,"venue":null,"work_id":"b7c1d148-e94e-40da-97a8-096d5c7c3b45","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.281645Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:a287d6c4cea11d01345f512392a123e052e4b2708cd6e79b0c14fd5eaed245f1","observation_id":"caa99421-ff7d-4586-8b49-aaa8c68b944b","resolution":{"observed_at":"2026-08-07T00:14:32.187735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.932138Z","title":null,"venue":null,"work_id":"56bf3f63-a13c-454c-a2ce-1440ec447193","year":2025},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.367647Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:7c1daca01ed3894e3e384bbd2e2de0cefcb8821dd4281865e7d754529791a5f4","observation_id":"e787a441-dde1-4c66-908a-035bd80af166","resolution":{"observed_at":"2026-08-07T00:14:32.007190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.734967Z","title":null,"venue":null,"work_id":"5be314fe-a465-485e-8f0b-5e3f47d58ef6","year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.460250Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:d8e66b07ccb44b99fa1075c0bd1507b41d833bd2744de5373a4d7852d818f90a","observation_id":"83ac5525-4b7e-45d1-a812-40c5b669644d","resolution":{"observed_at":"2026-08-07T00:14:31.815356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.583327Z","title":null,"venue":null,"work_id":"c1810a0e-a349-4969-8558-7eb1a10f6dd5","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.535624Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:a577a0de21d8e5adbf36055b8527745a87430c650c8d6bf22d0551c8d26fee1f","observation_id":"846f8697-f880-44c2-99a2-954f8391d3b1","resolution":{"observed_at":"2026-08-07T00:14:31.643112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.424421Z","title":null,"venue":null,"work_id":"4210f952-b5d2-4099-8c1d-852c7dc3857c","year":2019},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.611042Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:65e88d0cfb14b761ec4d1d81c723e45bac44c18f3d9ce2e2d63cc794290b6d26","observation_id":"d23c7476-c50d-4cf3-96b7-cbf8df6b7a42","resolution":{"observed_at":"2026-08-07T00:14:31.490776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.705806Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.705806Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:f9beb1d6e66332a82a7c0588ad6769c3a5789dc86e8114959557187c77605843","observation_id":"5036ce68-6c07-4b62-8f95-1bdc6abd0f54","resolution":{"observed_at":"2026-08-07T00:14:20.705806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.262601Z","title":null,"venue":null,"work_id":"76fe3326-fb38-40c3-9ad8-0357d0205cc1","year":2019},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.806784Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:d2b93df7d7338a2de381ed125d22992566fca7bc5fdcb1276b20f26ce7d2d04c","observation_id":"8854bc2f-6744-4b9b-a550-a10c2e7c5ec2","resolution":{"observed_at":"2026-08-07T00:14:31.330369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.900940Z","title":"Jacobs, Michael I","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.900940Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:46a230e9d971812333a33c8d7c2b64cad4892b6c699e848b2003762e3ce38132","observation_id":"6e3b2312-967d-406a-a74c-59b5e99b40da","resolution":{"observed_at":"2026-08-07T00:14:20.900940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.098748Z","title":null,"venue":null,"work_id":"2d242d2f-1d7c-4b2e-a259-088466000edd","year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.087444Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:84f6cd9a7b39ec89ed00690fe92156b32732a4dabe42ff8d58eb3ddda33b5ffe","observation_id":"3a48046a-bc36-41cc-8e80-cb89e13cf849","resolution":{"observed_at":"2026-08-07T00:14:31.176257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:21.183161Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.183161Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:a0e2d7e9dda7eb4a8a0d50f029a734a15c6155f690c7328189c054f8efc087be","observation_id":"7f25f88f-1454-47b6-a312-1178986b59d2","resolution":{"observed_at":"2026-08-07T00:14:21.183161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:30.774603Z","title":null,"venue":null,"work_id":"a1e70850-8c21-42c8-a3a4-34007428db7c","year":2025},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.283503Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:727dbe2cfd01dd85ab9a3c7a44dbc73edac1473623060ca05fe823392fad069d","observation_id":"960ca0cb-1350-4071-9dcc-6181f5a7548e","resolution":{"observed_at":"2026-08-07T00:14:30.930130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:30.433670Z","title":null,"venue":null,"work_id":"98e1db3d-ef4b-4d0b-953d-9be1d6b2a8fa","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.372676Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:6f21c6f7746e0eda5e30c5d9d2fd39113f4e388867b6f6114f82b071a88364d9","observation_id":"ac93f555-a645-452d-89a2-0714e2f13398","resolution":{"observed_at":"2026-08-07T00:14:30.569719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:30.062127Z","title":null,"venue":null,"work_id":"d155910d-65e9-45ac-981f-aac804d32db7","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.439522Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:57eee97c64560362704de7428ed149b3cc114af020f3fa1648ac685bf3364c2d","observation_id":"22af8759-a386-4588-89da-c8b1648cff0a","resolution":{"observed_at":"2026-08-07T00:14:30.207601Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:29.719104Z","title":null,"venue":null,"work_id":"093545b5-6bb9-489f-88e9-da3182722200","year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.528982Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:086a9b2842fd04f8b62dfde890344d17a4e43a9d729deae7db7142ffddc1d2fb","observation_id":"5ac89ffa-f289-4285-b451-cf45bde3c213","resolution":{"observed_at":"2026-08-07T00:14:29.864106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:29.343663Z","title":null,"venue":null,"work_id":"a3a00287-163f-4bb6-b404-52353e7fd8ca","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.617719Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:d2f5df753120555ca0ef4cf96d9e665f16da4b4dbf70297bb57cb12e024ec7ad","observation_id":"4f29cf24-383a-4aca-82f9-a60cc22510f2","resolution":{"observed_at":"2026-08-07T00:14:29.516348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:29.007123Z","title":null,"venue":null,"work_id":"3cf20682-c58e-482c-bea6-d9002348a925","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.715971Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:0ad891535d7ac994eb73d3cb207d570feb0f7554cd4e825008928725aa901219","observation_id":"24f03e98-3dcf-4b8e-a5d4-f643db16aa24","resolution":{"observed_at":"2026-08-07T00:14:29.141546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:28.678959Z","title":null,"venue":null,"work_id":"9d5fa225-1d34-4111-92e5-d74e670c8dc1","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.802949Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:2c8d8739c76379b8653bb8219e2f3cffcaa8ea1ddc450e207d0614028d8f39b1","observation_id":"d388dd37-642f-4a1a-b558-86b9d705ed9b","resolution":{"observed_at":"2026-08-07T00:14:28.835492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:28.105442Z","title":null,"venue":null,"work_id":"bb5e6e8f-8fa8-426d-af1b-e1e2b85e18e8","year":2019},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.951726Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:ede54ca42d9e42a77f708414cecfeceb77cdfd0596fe1bc8ca231ddbbea030f3","observation_id":"db20fb0d-3af5-4544-8e88-3a8b49ffc6af","resolution":{"observed_at":"2026-08-07T00:14:28.239691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.045150Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.045150Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:2e25c6e272bc4a372bb4c6342a8c54e218f8659961681cb400d7387922606d54","observation_id":"4fff5aff-1ead-463e-bf7e-42a407d9c586","resolution":{"observed_at":"2026-08-07T00:14:22.045150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.772634Z","title":null,"venue":null,"work_id":"e28f049f-0e55-43f5-ba65-2b7946e9d506","year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.105556Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:cb9aa0388d42e1bb9bfde39355148ce09f8d7b48d09475c326ecba6e9d64a15f","observation_id":"b7b646b9-99b7-49c2-a781-f24e320c33ee","resolution":{"observed_at":"2026-08-07T00:14:27.888051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.513045Z","title":null,"venue":null,"work_id":"ba2a9b02-4b42-43cd-b635-e1a4c8fa8a60","year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.195954Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:b776b973b08a6c183891ae0470be22b43b6c11b2bac266f17e139fd0ef2b1476","observation_id":"89de2c65-11d2-4a20-b5f8-d3b35e57920e","resolution":{"observed_at":"2026-08-07T00:14:27.643852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.325939Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.325939Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:b5b3b10b3af4dbd7f28d42601777e1b0e4dc81489d6a48bad3c849fe33f7cfa2","observation_id":"9bb0b866-ae30-4bbd-83cd-13cb1eb3939a","resolution":{"observed_at":"2026-08-07T00:14:22.325939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.426540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.426540Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:dfc56e086b6838352eaee74dcdc69a4812d8e5e3bb7f93d539bbf98ff3ca0bde","observation_id":"d4985e96-f6f4-4cc8-96bb-ba8e1eb1e426","resolution":{"observed_at":"2026-08-07T00:14:22.426540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.520193Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.520193Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:8186fc51f259fd8fc42a71013238ee6952f6e230603b062df8a338ee5c403d48","observation_id":"c83241df-2035-4864-9054-ca3c3711f560","resolution":{"observed_at":"2026-08-07T00:14:22.520193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.609658Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.609658Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:7e275954f4fcb7af73a8adf6a1a6a1e799c35959c75e266ea990ddc81532f80c","observation_id":"69a77d1e-4108-4daa-be96-37583a4398f2","resolution":{"observed_at":"2026-08-07T00:14:22.609658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.112180Z","title":null,"venue":null,"work_id":"276d2fbc-89e4-499a-9440-87ee4fda7ff5","year":2016},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.710869Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:2be790940b62fb9a77e96e7091300c5847c8fb294d5f7457f7ac6afe8f952c64","observation_id":"45b5feaa-b854-4b08-808e-5b7a24c5166f","resolution":{"observed_at":"2026-08-07T00:14:27.322257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.806966Z","title":null,"venue":null,"work_id":"82ed0b78-2829-4d0b-b620-981de2461cb1","year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.792003Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:2dacaa2755ea6bcf5f62d14407ec2e73814965d3e15769c016c00839fc47c04b","observation_id":"b4b1af53-f5e1-474c-a56f-f49c80523a35","resolution":{"observed_at":"2026-08-07T00:14:26.973612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.858229Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.858229Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:a19df368e69529d825bf9ce30eb992bb5238ed0bf408f1df1df4a4d9f419914b","observation_id":"fb865749-a448-4a9e-9e4f-c6a956c1e154","resolution":{"observed_at":"2026-08-07T00:14:22.858229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.930723Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.930723Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:0a63b0b92a2cd09ce4251ca0b90a421e460ac81f8bce07d812cebf1a82e6bb30","observation_id":"6ffccef8-d3cb-4a5d-bd0d-7e1238127457","resolution":{"observed_at":"2026-08-07T00:14:22.930723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.565130Z","title":null,"venue":null,"work_id":"00294463-3a96-46d9-a515-f39803130217","year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.046235Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:8f49ce417154cdc98a636a387080c1c7678ba8c93a1b3b2fe717c00d8278bd95","observation_id":"4837939f-8341-487a-aaad-301caba4150d","resolution":{"observed_at":"2026-08-07T00:14:26.664060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.120403Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.120403Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:b3d50107cef84c16cce4348a5cdeeb0723c161fdb7eb2aa47db5f4e1798ce22f","observation_id":"714d177a-2bc3-43b3-9821-f31a1ca0fa38","resolution":{"observed_at":"2026-08-07T00:14:23.120403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.315262Z","title":null,"venue":null,"work_id":"7519df79-8a67-4f7c-9fd1-e9b631906b1a","year":2025},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.190952Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:060e754a5330e9a89fa2a878a3fd5c1c364d09195b65ffaf2db7888b6da566fb","observation_id":"354f73e2-459c-483f-a295-ba7d0d285bd3","resolution":{"observed_at":"2026-08-07T00:14:26.432073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.057410Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":"742cc3b7-95a9-4690-8b73-0e325171c9d0","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.277274Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:cbb5090513c77ba2adffb0d0a9ab45decc3d888bf178c5ac978766c9e294c8e9","observation_id":"2edde84a-17f6-4b85-a922-5e7974fc5426","resolution":{"observed_at":"2026-08-07T00:14:26.177464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T00:14:23.365584Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.365584Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:30bed4a3927647b1dd6d9d0f1b006d4b879af6cb923b4fb27ba90c1b291d25c5","observation_id":"6e438b75-39d2-409d-9bcc-64072944a16d","resolution":{"observed_at":"2026-08-07T00:14:23.365584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.492828Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.492828Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:38ec93d050523ce10f68ad590bfc8a423604fff6feb157a277597010b8dea4e3","observation_id":"0a4c3f18-c5a7-4fd4-a5e9-843e0a8ba8a0","resolution":{"observed_at":"2026-08-07T00:14:23.492828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.577501Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.577501Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:efc3b64ac81cf2d2d6ae559d743dd18c222591fc46e246253de82df955ef3913","observation_id":"7906010b-5727-49ed-b766-ec8188371fbc","resolution":{"observed_at":"2026-08-07T00:14:23.577501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.ac","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.526008Z","title":null,"venue":null,"work_id":"6dff554a-8e0d-4c80-932f-2445dd21f438","year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.702583Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:b843bb70a241c04d013c064536247fe0711478e8fab369da8257323a723f6e56","observation_id":"171aa33a-5e26-4760-b54d-ed3cbcfd75f9","resolution":{"observed_at":"2026-08-07T00:14:24.570218Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.756148Z","title":null,"venue":null,"work_id":"9a5d8a87-dc23-4908-bfdb-3b4d2a63e381","year":2025},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.766617Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:dd9dc017cac8b72ad0cf98138044d83428a02ea6ee789e519ad386ac685b82e4","observation_id":"6bb763f3-2d0a-4d05-aee1-6f14ebc3afa8","resolution":{"observed_at":"2026-08-07T00:14:25.900133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.566791Z","title":null,"venue":null,"work_id":"d535d70f-5597-4a67-8576-aacdd9de5adb","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.885977Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:12c9d8f62c59255507529a958452c0984186244fdce03fba07c93c67b30cf7ee","observation_id":"1dc4770b-e6a9-4290-8d50-fa397cd8c037","resolution":{"observed_at":"2026-08-07T00:14:25.636037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T00:14:24.075701Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.075701Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:1747183d55ff796bcbfcea87cb5b160d5988acb554134a8e6e79352231d34118","observation_id":"6b3a84d7-0384-4687-9b47-ae6b68275150","resolution":{"observed_at":"2026-08-07T00:14:24.075701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.143376Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.143376Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:672439954981856779d440f0f0b979675b0589acf1adef2c633a24e798165a00","observation_id":"23d91c6c-3d4c-4627-8a1a-5e96edcb2de7","resolution":{"observed_at":"2026-08-07T00:14:24.143376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.36561","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.819531Z","title":null,"venue":null,"work_id":"a9469302-ba02-45dc-9ca2-a927ca26f6eb","year":2026},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.244169Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:d4ea7563756c98dafa654417c93b1770e7bd7de467b249cfda1a3004c51d0c6c","observation_id":"8f7da4ec-83f7-4523-908f-72aca85d2272","resolution":{"observed_at":"2026-08-07T00:14:24.869531Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13283","last_updated":"2024-02-11T11:38:38Z","snapshot_observed_at":"2026-08-08T18:11:37.937468Z","submitted_at":"2023-10-20T05:24:28Z","title":"pFedLoRA: Model-Heterogeneous Personalized Federated Learning with LoRA Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13283","snapshot_observed_at":"2026-08-07T00:14:24.328798Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.328798Z"},"links":{"cited_paper":"/paper/2310.13283","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:e3a5050c0447cb3323734fc7ca2c5c9aa4ad9985f2bb3eba594056ae32a5c37f","observation_id":"acef721a-b04a-48af-bee3-934db06a1a94","resolution":{"observed_at":"2026-08-07T00:14:24.328798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.218518Z","title":null,"venue":null,"work_id":"aa52badc-7dee-4a00-a9fc-c20c9d3cbd26","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.396122Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:518669cea4877ebd9915e6ad55821e43ef0df7053912b7d32ff14a3bac224f18","observation_id":"80a2e355-2909-4345-ad73-3fd71090e0d9","resolution":{"observed_at":"2026-08-07T00:14:25.311081Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.984530Z","title":"https://doi.org/10.1162/neco.1991.3.1.79","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.984530Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:cf3b70b3fd4d4ab83a762a3c72614462a1242b8d916aeb435df069338b266edc","observation_id":"d7940a4e-f10d-4a9d-931e-dee8c859266f","resolution":{"observed_at":"2026-08-07T00:14:20.984530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T00:14:22.999214Z","title":"arXiv:1707.06347 [cs.LG] https://arxiv.org/abs/1707.06347","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.999214Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:6d79128c5c46c1bf9e16ef85d4afcc94b48126d25eee6fc44f09111943bf4225","observation_id":"94c466e1-1c4f-48f4-9a52-cba77d919762","resolution":{"observed_at":"2026-08-07T00:14:22.999214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:28.410283Z","title":"World Wide Web26, 1 (2023), 481–500","venue":null,"work_id":"a93b4c87-d95b-479b-a43e-d3ce82dad026","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.876066Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:db7f2f37067ba859d192d94e12090934afa14f277d1f6c6a96ca7f2db9387ed3","observation_id":"9e3671e0-2607-4c15-8bfa-110907e9de8e","resolution":{"observed_at":"2026-08-07T00:14:28.496672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.854736Z","title":"InProceedings of the 41st International Conference on Machine Learning(Vienna, Austria)(ICML’24)","venue":null,"work_id":"d1122502-871d-46ca-85b7-c310ec29feaa","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.836791Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:5b55aac1b58404e6e6034d9f7445346f10fd9b9de739607917f93ba09dee7530","observation_id":"ea765af3-31c5-4ecb-b278-7907b7213bd8","resolution":{"observed_at":"2026-08-07T00:14:32.945096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.402003Z","title":"InThe Thirteenth International Conference on Learning Representations","venue":null,"work_id":"78aa5bcc-c343-4cd9-b597-871ba0105243","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.967304Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:e347e8e4a8daeb4b81920e4c0d7ba466db3133ebe6f1d0f1685eff0731485322","observation_id":"d413438f-d692-47fd-b292-7c65b93f67bd","resolution":{"observed_at":"2026-08-07T00:14:25.476774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T00:07:03.473655Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":50,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2608.01556."}