Pith. sign in

Paper Citation Record · LEDGER

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning

As of 9 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2608.01556.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.01556 v1

Coverage vector

measured 59 of 59 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T00:14:24.396122Z

measured 59 of 59 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

59 of 59 outbound references displayed

  • verified exact1
  • verified fuzzy5
  • unresolved50
  • parse uncertain0
  • malformed identifier2
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation cf1aef8b-b797-40a8-9455-2a7773913c5c · outbound

This paper cites A General Language Assistant as a Laboratory for Alignment.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning A General Language Assistant as a Laboratory for Alignment

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:19.305458Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:19.305458Z digest=sha256:56b742e53dee340f87445879506b57e9b28e9b1fe5565b727f6aee89326bd587

Observation fc26ea47-8f9e-4aa8-aa04-341129c2f729 · outbound

This paper cites Constitutional AI: Harmlessness from AI Feedback.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Constitutional AI: Harmlessness from AI Feedback

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:19.420535Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:19.420535Z digest=sha256:e72bf6b5ee0037d9954bd28a25a60764596d2a25811fa5fbc6257dfadbcc3636

Observation 3c045e10-ed19-42c8-ab96-5786153c51bc · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:33.661882Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:19.484960Z digest=sha256:fa6f3dd1bedee650af485de416fb13e9c3ecb8ba9ba088a53e2a675433d607a9

Observation 5ef32673-e7ed-4f87-9d25-02cb03312aae · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:33.496567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:19.572097Z digest=sha256:4fe4b78b69b8fbc07cfa78a2d0ccc98e0c0b1745795bd3870e092cf0a63719d8

Observation 4ef74a50-59e9-4f21-89e9-615ae3e334aa · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:33.272821Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:19.646153Z digest=sha256:f41b6f0ddb123ffea7a1d4321e55fbfbd5aea5ed399466c70400e2030e6dc0e5

Observation 736d5350-a397-4a15-8dfe-8ba0c79dbbf4 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:33.093799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:19.766575Z digest=sha256:8b1bd1f463724f8dabe570dc92a30eddb42daf7a5fddfd6c0e598bd45493b6b1

Observation 72e99b7f-9f38-41fd-8376-342c13b8b15c · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:32.782221Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:19.923314Z digest=sha256:80775e537837393dc441409bc357661e5d7c651d9442a3c29bb957ba69014ea5

Observation 0bac03e2-a3b5-4c6a-b1e6-c87eaa5f9378 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:32.597636Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:20.000449Z digest=sha256:eddda097e40d7597c786498d53d6b3ad00f18961d9ad70c28deeb935e4163f9b

Observation 4b13ea09-0741-408a-8647-629317b8fc87 · outbound

This paper cites Dinh, Nguyen H.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Dinh, Nguyen H

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:14:32.376593Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:20.094945Z digest=sha256:7a2b8527ec7933c3fcc55efba3f6e1cc0badf295789ae72f13699fdd17b24f77

Observation 9a3d4a59-c960-4513-9bf5-64caa8615a3c · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 10

Resolution
malformed identifier
no resolver link, observed 2026-08-07T00:14:20.195400Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:20.195400Z digest=sha256:95db3f37dff654c71ed99e77e872e21baa3794ccfbc2cac379d9dcda3634470c

Observation caa99421-ff7d-4586-8b49-aaa8c68b944b · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:32.187735Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:20.281645Z digest=sha256:a287d6c4cea11d01345f512392a123e052e4b2708cd6e79b0c14fd5eaed245f1

Observation e787a441-dde1-4c66-908a-035bd80af166 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:32.007190Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:20.367647Z digest=sha256:7c1daca01ed3894e3e384bbd2e2de0cefcb8821dd4281865e7d754529791a5f4

Observation 83ac5525-4b7e-45d1-a812-40c5b669644d · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:31.815356Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:20.460250Z digest=sha256:d8e66b07ccb44b99fa1075c0bd1507b41d833bd2744de5373a4d7852d818f90a

Observation 846f8697-f880-44c2-99a2-954f8391d3b1 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:31.643112Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:20.535624Z digest=sha256:a577a0de21d8e5adbf36055b8527745a87430c650c8d6bf22d0551c8d26fee1f

Observation d23c7476-c50d-4cf3-96b7-cbf8df6b7a42 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:31.490776Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:20.611042Z digest=sha256:65e88d0cfb14b761ec4d1d81c723e45bac44c18f3d9ce2e2d63cc794290b6d26

Observation 5036ce68-6c07-4b62-8f95-1bdc6abd0f54 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:20.705806Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:20.705806Z digest=sha256:f9beb1d6e66332a82a7c0588ad6769c3a5789dc86e8114959557187c77605843

Observation 8854bc2f-6744-4b9b-a550-a10c2e7c5ec2 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:31.330369Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:20.806784Z digest=sha256:d2b93df7d7338a2de381ed125d22992566fca7bc5fdcb1276b20f26ce7d2d04c

Observation 6e3b2312-967d-406a-a74c-59b5e99b40da · outbound

This paper cites Jacobs, Michael I.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Jacobs, Michael I

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:20.900940Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:20.900940Z digest=sha256:46a230e9d971812333a33c8d7c2b64cad4892b6c699e848b2003762e3ce38132

Observation 3a48046a-bc36-41cc-8e80-cb89e13cf849 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:31.176257Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.087444Z digest=sha256:84f6cd9a7b39ec89ed00690fe92156b32732a4dabe42ff8d58eb3ddda33b5ffe

Observation 7f25f88f-1454-47b6-a312-1178986b59d2 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:21.183161Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:21.183161Z digest=sha256:a0e2d7e9dda7eb4a8a0d50f029a734a15c6155f690c7328189c054f8efc087be

Observation 960ca0cb-1350-4071-9dcc-6181f5a7548e · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:30.930130Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.283503Z digest=sha256:727dbe2cfd01dd85ab9a3c7a44dbc73edac1473623060ca05fe823392fad069d

Observation ac93f555-a645-452d-89a2-0714e2f13398 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:30.569719Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.372676Z digest=sha256:6f21c6f7746e0eda5e30c5d9d2fd39113f4e388867b6f6114f82b071a88364d9

Observation 22af8759-a386-4588-89da-c8b1648cff0a · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:30.207601Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.439522Z digest=sha256:57eee97c64560362704de7428ed149b3cc114af020f3fa1648ac685bf3364c2d

Observation 5ac89ffa-f289-4285-b451-cf45bde3c213 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:29.864106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.528982Z digest=sha256:086a9b2842fd04f8b62dfde890344d17a4e43a9d729deae7db7142ffddc1d2fb

Observation 4f29cf24-383a-4aca-82f9-a60cc22510f2 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:29.516348Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.617719Z digest=sha256:d2f5df753120555ca0ef4cf96d9e665f16da4b4dbf70297bb57cb12e024ec7ad

Observation 24f03e98-3dcf-4b8e-a5d4-f643db16aa24 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:29.141546Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.715971Z digest=sha256:0ad891535d7ac994eb73d3cb207d570feb0f7554cd4e825008928725aa901219

Observation d388dd37-642f-4a1a-b558-86b9d705ed9b · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:28.835492Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.802949Z digest=sha256:2c8d8739c76379b8653bb8219e2f3cffcaa8ea1ddc450e207d0614028d8f39b1

Observation db20fb0d-3af5-4544-8e88-3a8b49ffc6af · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:28.239691Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.951726Z digest=sha256:ede54ca42d9e42a77f708414cecfeceb77cdfd0596fe1bc8ca231ddbbea030f3

Observation 4fff5aff-1ead-463e-bf7e-42a407d9c586 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:22.045150Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:22.045150Z digest=sha256:2e25c6e272bc4a372bb4c6342a8c54e218f8659961681cb400d7387922606d54

Observation b7b646b9-99b7-49c2-a781-f24e320c33ee · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:27.888051Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:22.105556Z digest=sha256:cb9aa0388d42e1bb9bfde39355148ce09f8d7b48d09475c326ecba6e9d64a15f

Observation 89de2c65-11d2-4a20-b5f8-d3b35e57920e · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:27.643852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:22.195954Z digest=sha256:b776b973b08a6c183891ae0470be22b43b6c11b2bac266f17e139fd0ef2b1476

Observation 9bb0b866-ae30-4bbd-83cd-13cb1eb3939a · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:22.325939Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:22.325939Z digest=sha256:b5b3b10b3af4dbd7f28d42601777e1b0e4dc81489d6a48bad3c849fe33f7cfa2

Observation d4985e96-f6f4-4cc8-96bb-ba8e1eb1e426 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:22.426540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:22.426540Z digest=sha256:dfc56e086b6838352eaee74dcdc69a4812d8e5e3bb7f93d539bbf98ff3ca0bde

Observation c83241df-2035-4864-9054-ca3c3711f560 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:22.520193Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:22.520193Z digest=sha256:8186fc51f259fd8fc42a71013238ee6952f6e230603b062df8a338ee5c403d48

Observation 69a77d1e-4108-4daa-be96-37583a4398f2 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:22.609658Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:22.609658Z digest=sha256:7e275954f4fcb7af73a8adf6a1a6a1e799c35959c75e266ea990ddc81532f80c

Observation 45b5feaa-b854-4b08-808e-5b7a24c5166f · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:27.322257Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:22.710869Z digest=sha256:2be790940b62fb9a77e96e7091300c5847c8fb294d5f7457f7ac6afe8f952c64

Observation b4b1af53-f5e1-474c-a56f-f49c80523a35 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 37

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:26.973612Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:22.792003Z digest=sha256:2dacaa2755ea6bcf5f62d14407ec2e73814965d3e15769c016c00839fc47c04b

Observation fb865749-a448-4a9e-9e4f-c6a956c1e154 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:22.858229Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:22.858229Z digest=sha256:a19df368e69529d825bf9ce30eb992bb5238ed0bf408f1df1df4a4d9f419914b

Observation 6ffccef8-d3cb-4a5d-bd0d-7e1238127457 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:22.930723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:22.930723Z digest=sha256:0a63b0b92a2cd09ce4251ca0b90a421e460ac81f8bce07d812cebf1a82e6bb30

Observation 4837939f-8341-487a-aaad-301caba4150d · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:26.664060Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:23.046235Z digest=sha256:8f49ce417154cdc98a636a387080c1c7678ba8c93a1b3b2fe717c00d8278bd95

Observation 714d177a-2bc3-43b3-9821-f31a1ca0fa38 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:23.120403Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:23.120403Z digest=sha256:b3d50107cef84c16cce4348a5cdeeb0723c161fdb7eb2aa47db5f4e1798ce22f

Observation 354f73e2-459c-483f-a295-ba7d0d285bd3 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:26.432073Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:23.190952Z digest=sha256:060e754a5330e9a89fa2a878a3fd5c1c364d09195b65ffaf2db7888b6da566fb

Observation 2edde84a-17f6-4b85-a922-5e7974fc5426 · outbound

This paper cites Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:14:26.177464Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:23.277274Z digest=sha256:cbb5090513c77ba2adffb0d0a9ab45decc3d888bf178c5ac978766c9e294c8e9

Observation 6e438b75-39d2-409d-9bcc-64072944a16d · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Gemma: Open Models Based on Gemini Research and Technology

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:23.365584Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:23.365584Z digest=sha256:30bed4a3927647b1dd6d9d0f1b006d4b879af6cb923b4fb27ba90c1b291d25c5

Observation 0a4c3f18-c5a7-4fd4-a5e9-843e0a8ba8a0 · outbound

This paper cites Gomez, Łukasz Kaiser, and Illia Polosukhin.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Gomez, Łukasz Kaiser, and Illia Polosukhin

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:23.492828Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:23.492828Z digest=sha256:38ec93d050523ce10f68ad590bfc8a423604fff6feb157a277597010b8dea4e3

Observation 7906010b-5727-49ed-b766-ec8188371fbc · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:23.577501Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:23.577501Z digest=sha256:efc3b64ac81cf2d2d6ae559d743dd18c222591fc46e246253de82df955ef3913

Observation 171aa33a-5e26-4760-b54d-ed3cbcfd75f9 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 47

Resolution
verified exact
doi, observed 2026-08-07T00:14:24.570218Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:23.702583Z digest=sha256:b843bb70a241c04d013c064536247fe0711478e8fab369da8257323a723f6e56

Observation 6bb763f3-2d0a-4d05-aee1-6f14ebc3afa8 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 48

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:25.900133Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:23.766617Z digest=sha256:dd9dc017cac8b72ad0cf98138044d83428a02ea6ee789e519ad386ac685b82e4

Observation 1dc4770b-e6a9-4290-8d50-fa397cd8c037 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 49

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:14:25.636037Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:23.885977Z digest=sha256:12c9d8f62c59255507529a958452c0984186244fdce03fba07c93c67b30cf7ee

Observation 6b3a84d7-0384-4687-9b47-ae6b68275150 · outbound

This paper cites Qwen2 Technical Report.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Qwen2 Technical Report

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:24.075701Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:24.075701Z digest=sha256:1747183d55ff796bcbfcea87cb5b160d5988acb554134a8e6e79352231d34118

Observation 23d91c6c-3d4c-4627-8a1a-5e96edcb2de7 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:24.143376Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:24.143376Z digest=sha256:672439954981856779d440f0f0b979675b0589acf1adef2c633a24e798165a00

Observation 8f7da4ec-83f7-4523-908f-72aca85d2272 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 52

Resolution
metadata mismatch
raw_fallback, observed 2026-08-07T00:14:24.869531Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:24.244169Z digest=sha256:d4ea7563756c98dafa654417c93b1770e7bd7de467b249cfda1a3004c51d0c6c

Observation acef721a-b04a-48af-bee3-934db06a1a94 · outbound

This paper cites pFedLoRA: Model-Heterogeneous Personalized Federated Learning with LoRA Tuning.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning pFedLoRA: Model-Heterogeneous Personalized Federated Learning with LoRA Tuning

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:24.328798Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:24.328798Z digest=sha256:e3a5050c0447cb3323734fc7ca2c5c9aa4ad9985f2bb3eba594056ae32a5c37f

Observation 80a2e355-2909-4345-ad73-3fd71090e0d9 · outbound

This paper cites an unresolved cited work.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Unresolved cited work

Reference 54

Resolution
malformed identifier
raw_fallback, observed 2026-08-07T00:14:25.311081Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:24.396122Z digest=sha256:518669cea4877ebd9915e6ad55821e43ef0df7053912b7d32ff14a3bac224f18

Observation d7940a4e-f10d-4a9d-931e-dee8c859266f · outbound

This paper cites https://doi.org/10.1162/neco.1991.3.1.79.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning https://doi.org/10.1162/neco.1991.3.1.79

Reference 1991

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:20.984530Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:20.984530Z digest=sha256:cf3b70b3fd4d4ab83a762a3c72614462a1242b8d916aeb435df069338b266edc

Observation 94c466e1-1c4f-48f4-9a52-cba77d919762 · outbound

This paper cites Proximal Policy Optimization Algorithms.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning Proximal Policy Optimization Algorithms

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-07T00:14:22.999214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:14:22.999214Z digest=sha256:6d79128c5c46c1bf9e16ef85d4afcc94b48126d25eee6fc44f09111943bf4225

Observation 9e3671e0-2607-4c15-8bfa-110907e9de8e · outbound

This paper cites World Wide Web26, 1 (2023), 481–500.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning World Wide Web26, 1 (2023), 481–500

Reference 2023

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:14:28.496672Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:21.876066Z digest=sha256:db7f2f37067ba859d192d94e12090934afa14f277d1f6c6a96ca7f2db9387ed3

Observation ea765af3-31c5-4ecb-b278-7907b7213bd8 · outbound

This paper cites InProceedings of the 41st International Conference on Machine Learning(Vienna, Austria)(ICML’24).

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning InProceedings of the 41st International Conference on Machine Learning(Vienna, Austria)(ICML’24)

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:14:32.945096Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:19.836791Z digest=sha256:5b55aac1b58404e6e6034d9f7445346f10fd9b9de739607917f93ba09dee7530

Observation d413438f-d692-47fd-b292-7c65b93f67bd · outbound

This paper cites InThe Thirteenth International Conference on Learning Representations.

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning InThe Thirteenth International Conference on Learning Representations

Reference 2025

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:14:25.476774Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T00:14:23.967304Z digest=sha256:e347e8e4a8daeb4b81920e4c0d7ba466db3133ebe6f1d0f1685eff0731485322

Pith citing papers

No inbound Pith citation observations are available.