{"as_of":"2026-08-18T09:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed6b5dc4b29b4842ac7a1f85454d3ce4f48edae89f2cea15d5e9a2b9e2b2d71d","coverage":[{"denominator":8,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:15:38.248174Z","state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10126/citation-record","integrity":"/paper/2608.10126/integrity","json":"/paper/2608.10126/citation-record.json","paper":"/paper/2608.10126"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-16T00:15:57.597094Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-14T04:15:38.192422Z","title":"and Stiennon, Nisan and Wu, Jeffrey and Brown, Tom B","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:38.192422Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2608.10126"},"observation_digest":"sha256:8fd0d64c03d3f2e9c683f7e305ed9586c41ff4b5785f7f710a1f7d5ab9696422","observation_id":"c92d9153-955f-4409-8c5f-ff86cac16482","resolution":{"observed_at":"2026-08-14T04:15:38.192422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-14T04:15:38.198111Z","title":"arXiv preprint arXiv:2203.02155 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:38.198111Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2608.10126"},"observation_digest":"sha256:1da42cdb42dd8d253752a87b09340a8802a9124fd72b677d3bb893b518eae41f","observation_id":"d21df635-6ffb-4a7e-96ce-dc14de00ba1c","resolution":{"observed_at":"2026-08-14T04:15:38.198111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16791","last_updated":"2024-10-22T08:12:38Z","snapshot_observed_at":"2026-08-16T13:07:05.267043Z","submitted_at":"2024-10-22T08:12:38Z","title":"$\\textit{Ab initio}$ dynamical mean-field theory with natural orbitals renormalization group impurity solver: Formalism and applications","version":1},"cited_work":{"arxiv_id":"2410.16791","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.16791","snapshot_observed_at":"2026-08-14T04:15:38.397473Z","title":"$\\textit{Ab initio}$ dynamical mean-field theory with natural orbitals renormalization group impurity solver: Formalism and applications","venue":"cond-mat.str-el","work_id":"ddcddcfa-fee1-4b66-98ce-2fbe8824fe0f","year":2024},"citing_paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:38.207974Z"},"links":{"cited_paper":"/paper/2410.16791","citing_paper":"/paper/2608.10126"},"observation_digest":"sha256:a53ed70646bc0ece8d93040f9c3cec5d8d9c7741547c62a012ba38ac0dda71aa","observation_id":"e3766b2a-9706-466f-a019-2b51725111a8","resolution":{"observed_at":"2026-08-14T04:15:38.406721Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04993","last_updated":"2025-05-08T06:59:06Z","snapshot_observed_at":"2026-08-17T22:14:20.253479Z","submitted_at":"2025-05-08T06:59:06Z","title":"Latent Preference Coding: Aligning Large Language Models via Discrete Latent Codes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04993","snapshot_observed_at":"2026-08-14T04:15:38.214421Z","title":"arXiv preprint arXiv:2505.04993 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:38.214421Z"},"links":{"cited_paper":"/paper/2505.04993","citing_paper":"/paper/2608.10126"},"observation_digest":"sha256:a7fe4e5646ce6392600e3e1a2f6e82cfddf6555736f0c49fd7feba92d22d2032","observation_id":"ec071893-9b6d-49e0-9113-6bd73884dc47","resolution":{"observed_at":"2026-08-14T04:15:38.214421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19085","last_updated":"2024-10-11T08:21:50Z","snapshot_observed_at":"2026-08-16T14:14:11.354813Z","submitted_at":"2024-02-29T12:12:30Z","title":"Controllable Preference Optimization: Toward Controllable Multi-Objective Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19085","snapshot_observed_at":"2026-08-14T04:15:38.222855Z","title":"arXiv preprint arXiv:2402.19085 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:38.222855Z"},"links":{"cited_paper":"/paper/2402.19085","citing_paper":"/paper/2608.10126"},"observation_digest":"sha256:1cb2d49bd79746ea9e8d95bf33df8d4b96e487b9b6c234cd2dfc40262dabbfae","observation_id":"006d9a92-e3d2-4474-ae74-e729b55f641a","resolution":{"observed_at":"2026-08-14T04:15:38.222855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07070","last_updated":"2025-04-09T17:39:58Z","snapshot_observed_at":"2026-08-16T12:42:37.825168Z","submitted_at":"2025-04-09T17:39:58Z","title":"A Survey on Personalized and Pluralistic Preference Alignment in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07070","snapshot_observed_at":"2026-08-14T04:15:38.236029Z","title":"arXiv preprint arXiv:2504.07070 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:38.236029Z"},"links":{"cited_paper":"/paper/2504.07070","citing_paper":"/paper/2608.10126"},"observation_digest":"sha256:4107411d06e6103669419131ea9788486b8a8c03052379be2517cf34d17316f4","observation_id":"e19d68a7-45bd-4d12-a5aa-d51ef1e1a873","resolution":{"observed_at":"2026-08-14T04:15:38.236029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:15:38.467910Z","title":null,"venue":null,"work_id":"8a93246b-b339-49c8-b0d4-62ee530781f1","year":null},"citing_paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:38.242008Z"},"links":{"citing_paper":"/paper/2608.10126"},"observation_digest":"sha256:2217f81d20ca37dbdd0a82f260a4ec85a66495eed5dd9ce765ffc6e9e6198732","observation_id":"ca990641-9310-4004-a49f-2cf44770d3a6","resolution":{"observed_at":"2026-08-14T04:15:38.473629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05453","last_updated":"2023-03-09T17:52:07Z","snapshot_observed_at":"2026-08-16T17:49:19.639103Z","submitted_at":"2023-03-09T17:52:07Z","title":"Personalisation within bounds: A risk taxonomy and policy framework for the alignment of large language models with personalised feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05453","snapshot_observed_at":"2026-08-14T04:15:38.248174Z","title":"arXiv preprint arXiv:2303.05453 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:15:38.248174Z"},"links":{"cited_paper":"/paper/2303.05453","citing_paper":"/paper/2608.10126"},"observation_digest":"sha256:1d97af0378c4603e92554cc1e87042033b85aaf4d0174cda1b51f137310d2e63","observation_id":"00a91046-ce5b-4259-9251-58c85057b1f6","resolution":{"observed_at":"2026-08-14T04:15:38.248174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.10126","last_updated":"2026-08-10T18:38:16Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T05:01:12.522704Z","submitted_at":"2026-08-10T18:38:16Z","title":"Procedural Fairness Failures in RLHF from Preference Averaging"},"reference_resolution":{"displayed":8,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":8},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 8 of 8 outbound references and 0 inbound Pith citation observations for arXiv:2608.10126."}