{"as_of":"2026-08-07T16:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:70b525c59de3728ec027d12d8a5891d3767fc9e1a345345dc78095b6d0f0c3f6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:15:18.352301Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T16:18:01.698451Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":"2410.02197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, G","venue":null,"work_id":"43d53d4e-6b6a-439c-b001-56d60f968045","year":null},"citing_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-17T16:18:01.560780Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2410.18451"},"observation_digest":"sha256:2199d16371de5638fdcf53742127b8ecbca6dbba3974dca95fb362837098760b","observation_id":"dd59daf8-f9fa-4de9-af3a-ee60d8c2581c","resolution":{"observed_at":"2026-05-17T16:18:01.700871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-08-07T15:15:18.352301Z","title":"General preference modeling with preference representations for aligning language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15710","last_updated":"2025-05-21T16:21:29Z","snapshot_observed_at":"2026-08-07T15:10:26.359936Z","submitted_at":"2025-05-21T16:21:29Z","title":"Advancing LLM Safe Alignment with Safety Representation Ranking","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:18.352301Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2505.15710"},"observation_digest":"sha256:1fceda925ffe88d7b946df8e01c68ad6c29ae25f105adb7d1759abaee8af50d2","observation_id":"512519c3-7e96-443f-9916-7cb34fcf72c8","resolution":{"observed_at":"2026-08-07T15:15:18.352301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-08-06T18:52:38.799899Z","title":"Zhang, G","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07855","last_updated":"2026-06-22T14:01:09Z","snapshot_observed_at":"2026-08-06T18:28:35.982595Z","submitted_at":"2025-07-10T15:38:17Z","title":"DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory (and its Loss' Convexity is Dispensable)","version":4},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T18:52:38.799899Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2507.07855"},"observation_digest":"sha256:ecd0c59ee6984ed4ce795d046a5a5789277395e54f2a8842ec43382883cc1b6b","observation_id":"87ebc61f-baca-466e-855a-47b090309761","resolution":{"observed_at":"2026-08-06T18:52:38.799899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-08-06T12:54:38.169486Z","title":"General preference modeling with preference rep- resentations for aligning language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21391","last_updated":"2025-07-30T04:49:38Z","snapshot_observed_at":"2026-08-06T15:49:24.780563Z","submitted_at":"2025-07-28T23:52:53Z","title":"Multimodal LLMs as Customized Reward Models for Text-to-Image Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T12:54:38.169486Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2507.21391"},"observation_digest":"sha256:2765c58e5cf257fffffb9e74847218faf6eaaed0bc6d9642d1f67bd80bc38eab","observation_id":"a5e53093-eb1b-4ff2-9218-0079c8c509a9","resolution":{"observed_at":"2026-08-06T12:54:38.169486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":"2410.02197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, G","venue":null,"work_id":"43d53d4e-6b6a-439c-b001-56d60f968045","year":null},"citing_paper":{"arxiv_id":"2605.07724","last_updated":"2026-06-03T12:55:17Z","snapshot_observed_at":"2026-07-06T23:20:06.574823Z","submitted_at":"2026-05-08T13:27:23Z","title":"Curated Synthetic Data Doesn't Have to Collapse: A Theoretical Study of Generative Retraining with Pluralistic Preferences","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-11T02:30:14.693348Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2605.07724"},"observation_digest":"sha256:21dcd22cd3172cf59b8cdd29a563593c2a142ed9d97921eee7c6291f83efb648","observation_id":"37073495-2332-4e24-ac41-4e3b58d7e906","resolution":{"observed_at":"2026-05-11T02:30:54.367385Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":"2410.02197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, G","venue":null,"work_id":"43d53d4e-6b6a-439c-b001-56d60f968045","year":null},"citing_paper":{"arxiv_id":"2605.09214","last_updated":"2026-05-09T23:17:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-09T23:17:46Z","title":"Fast Rates for Offline Contextual Bandits with Forward-KL Regularization under Single-Policy Concentrability","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-12T03:47:14.379908Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2605.09214"},"observation_digest":"sha256:c876cd39b91212d9cf1e404ebd554bd14e4b35dbd64d6ee112b0154ff383cece","observation_id":"4fb04080-5ac2-4387-bc6d-42bedcb39faa","resolution":{"observed_at":"2026-05-12T06:56:30.944683Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.02197/citation-record","integrity":"/paper/2410.02197/integrity","json":"/paper/2410.02197/citation-record.json","paper":"/paper/2410.02197"},"outbound":[],"paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2410.02197."}