Pith. sign in

Paper Citation Record · LEDGER

A Regret Minimization Framework on Preference Learning in Large Language Models

As of 9 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2606.09124.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2606.09124 v1

Coverage vector

measured 25 of 25 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-06-27T16:34:19.323865Z

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

25 of 25 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved22
  • parse uncertain1
  • malformed identifier2
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 960af314-a171-4893-b5e7-fac0da6c4744 · outbound

This paper cites Contrastive Preference Learning: Learning from Human Feedback without RL.

A Regret Minimization Framework on Preference Learning in Large Language Models Contrastive Preference Learning: Learning from Human Feedback without RL

Reference 1

Resolution
malformed identifier
arxiv_id, observed 2026-07-03T01:27:30.773321Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:28cd806525f19f3a9e12936e99b83c076d4e21140ed64a111047c49bd4e40b8d

Observation c088cb7e-006f-45ea-bf2f-e2f7aa8186b6 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 2

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:0beb5772a71fc4ce4f6a245ca60bf7e58a8af54e13771ac95dd36412c5685166

Observation d8870e10-d208-4524-8ebd-534d6d2267b6 · outbound

This paper cites Over 13 weeks (since2×13 = 26), he will play: 26games.

A Regret Minimization Framework on Preference Learning in Large Language Models Over 13 weeks (since2×13 = 26), he will play: 26games

Reference 3

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:2d88dea5205a9a9b84824d7045d994326bb5317d3adedbed98b299e04244644d

Observation d784adb6-8075-4808-ad1e-28a82d523fa1 · outbound

This paper cites Therefore, the total number of hits is: 20×2 = 40hits.

A Regret Minimization Framework on Preference Learning in Large Language Models Therefore, the total number of hits is: 20×2 = 40hits

Reference 4

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:d2376522df0ee90bb2ae68938498f02627e8aeee874a652bb322c775de86c217

Observation 584ca7c1-8c78-4c7e-8768-c1c0c83408c2 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 5

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:1f3fe4115a5b3605ca63ff7d7f487f3610e51fccf90577735c40cd3162c363f1

Observation 2c8aeb76-0f5a-4afd-8299-d113ae0daaa4 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 6

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:34a7ef8626331f508ea25f7212e63fab480ed5c22b7f5d58786b88517105d49f

Observation 8010dda7-48f9-481e-8e7e-87ad02d9e5da · outbound

This paper cites Instruction.

A Regret Minimization Framework on Preference Learning in Large Language Models Instruction

Reference 7

Resolution
malformed identifier
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:416de197d48bbe823e5df360fa3401741378d293ba73962ee3bd76b5ea8f22f3

Observation f55164d1-2d88-4f62-a6c6-7360a4c58898 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 8

Resolution
parse uncertain
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:e19f688abc788e52733b42aee8c03e11826cbb6b02839d1705c8c8f201a5db66

Observation 2b496372-3976-4a53-8baf-4458aa511d36 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:08071dd1c5ad776f807091c493f02fe54fc72a7a0749fccecb6aa469a46236eb

Observation e3909ce5-5f28-4e5a-b8a8-6b6e3bc1a705 · outbound

This paper cites (2) Acknowledges both but slight deviations.

A Regret Minimization Framework on Preference Learning in Large Language Models (2) Acknowledges both but slight deviations

Reference 10

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:57af8e4a07241524ac585583f7241184cf6e0660e2d58018e7e5ba34872bb015

Observation fdc7e3a5-a037-43e1-81aa-0f4b19983b7f · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 11

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:81081f73a35462dc17e4f7bebce46e5e67d874d1a4a20b8917a3ec39acfd6a14

Observation 8c1f2a50-f5b3-4c84-a8e8-bcb59fd42a3d · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 12

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:c3ff3093b05749936c2eb9519d65911311537cc1c21476b10322963b9a6df0bb

Observation 70cd7977-4d70-465b-80a0-dc0462c6b2e3 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 13

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:4cb4f85b83a8cb5cfa373fc70684c7959f45e90cb13904776d4d6c41f8382d62

Observation a29679cc-127b-4ca3-9231-ec2f8c17b3f3 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 14

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:c57f27edbe2b935cfd37dacc050cd88259b10546f80398cacea5f2b8384c68e2

Observation a303b3c8-bda2-499a-b781-f38aa5fe1887 · outbound

This paper cites Score 1 to 5 based on extent of helpfulness, regarding both informativeness and correctness:.

A Regret Minimization Framework on Preference Learning in Large Language Models Score 1 to 5 based on extent of helpfulness, regarding both informativeness and correctness:

Reference 15

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:ed50f2fdb73a82a27523dc943097d85a9175bcc8d21cf65e23b0d05643a233c9

Observation 3400d4c4-77e1-4959-b294-8342473d9aea · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 16

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:33cf127f9c90529ea13efa7137a8d0106648dedb74cc5ce90cda85091b75cf1f

Observation 088ec125-1156-4918-b00a-9e0dc1a21823 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 17

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:3fb14cb59479fb49b8cdefc5d83d8eac8fe862d499b462518499afd8587f75b4

Observation 1153fc5e-d248-4d08-ac48-b43eff7a7a96 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 18

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:559b163fe7edee90726024c649406c46e5414235b0d11b50dfef6a4b82dc7c1c

Observation 0e5a9211-a84e-4d28-96da-f8083ccb4fc5 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 19

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:4833c74c6480c70053aeeb9e9b705bbf7e2e0ab2901b801c091969e9693b82ae

Observation 84e6d2f8-d64b-43ce-939f-b93741afa15d · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:ee9fee8dc09e7bd81bd77e983d949664a229668b32cbc136ce54fdbea64041e7

Observation fe474f81-f89d-4700-a371-5f59f3e868d8 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:16530f96dce7fddb74313d7a835262e0c029c5d340901522bb1505ce8d462eee

Observation f7e42b9d-3ad4-4ebc-8f00-bbcfcde6476b · outbound

This paper cites • No uncertainty expression indicate confidence.

A Regret Minimization Framework on Preference Learning in Large Language Models • No uncertainty expression indicate confidence

Reference 22

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:b8aae155513cf9fd8719ff2dcada6353cccf13efb01881782c711f55e1bf4293

Observation 47c65554-f2d3-43b3-b6dd-021639c48e46 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 23

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:c072d94f4e9ebc424c45b1d15d3aa58e0a17081506cddcbaddcf2ab7776ea903

Observation 7943eb37-cfcb-4f4c-afcb-2adde19bb922 · outbound

This paper cites an unresolved cited work.

A Regret Minimization Framework on Preference Learning in Large Language Models Unresolved cited work

Reference 24

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:cd2bd2268df991eb744ae985844ec29d0dec8f3bd4ffca5a1b26274c51312505

Observation c8b34346-d88d-438f-ab2c-e3698da9a8d0 · outbound

This paper cites Scoring:Rate outputs 1 to 5 based on extent of hallucination: 1.Completely Hallucinated:Entirely unreliable due to hallucinations.

A Regret Minimization Framework on Preference Learning in Large Language Models Scoring:Rate outputs 1 to 5 based on extent of hallucination: 1.Completely Hallucinated:Entirely unreliable due to hallucinations

Reference 25

Resolution
unresolved
no resolver link, observed 2026-06-27T16:34:19.323865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-27T16:34:19.323865Z digest=sha256:110e0777861b72f3d04ea5ee2975f2713bb33f850055c14fbc8a8388612fc347

Pith citing papers

No inbound Pith citation observations are available.