Pith. sign in

Paper Citation Record · LEDGER

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators

As of 16 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2607.14480.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.14480 v2

Coverage vector

measured 12 of 12 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T02:01:39.101161Z

measured 12 of 12 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

12 of 12 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved12
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 8f40e6c9-9e73-411d-b31c-94e5a6af5e6b · outbound

This paper cites an unresolved cited work.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators Unresolved cited work

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:38.893844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:38.893844Z digest=sha256:59e6fa9297d1f8c91529d84d03931794e41cd4b6aac1ff115a4e54d263a3d87c

Observation 9a7e08bb-1443-4817-a2c7-88c9f8f3628c · outbound

This paper cites SCORE: (an integer number between 1 and 5).

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators SCORE: (an integer number between 1 and 5)

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:39.008631Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:39.008631Z digest=sha256:4532522b0e3a56cdb0517572f978fe8c3ad2f4e460de2c6fd61ff312a5f8a344

Observation c1c2a8bb-0f2b-49f8-8fff-a6a27b1792f8 · outbound

This paper cites role": "user.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators role": "user

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:39.101161Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:39.101161Z digest=sha256:9ce9236d37a22d40c7262e23e6c8e69cb9b7edb0303c4c4ec5c1367eab3061c9

Observation 58cb64b8-e4d3-4292-85ac-1224655444e2 · outbound

This paper cites ToxiLab: How Well Do Open-Source LLMs Generate Synthetic Toxicity Data?.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators ToxiLab: How Well Do Open-Source LLMs Generate Synthetic Toxicity Data?

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:38.247726Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:38.247726Z digest=sha256:ad2d05372a3fbae74455b27c158f38e42d83443e6fb3c2f458931cb7257c054e

Observation 69bdf272-e63f-4d5d-9a5d-062dab6f10de · outbound

This paper cites Language Model Tokenizers Introduce Unfairness Between Languages.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators Language Model Tokenizers Introduce Unfairness Between Languages

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:38.447490Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:38.447490Z digest=sha256:985f7e598ef9952ebb995a01a691b9e048eee23677e0d82192bdae8d36bc8c4f

Observation dde30d0f-3919-4501-abeb-d4433f2ac826 · outbound

This paper cites doi: 10.18653/v1/2024.naacl-long.301.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators doi: 10.18653/v1/2024.naacl-long.301

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:38.605176Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:38.605176Z digest=sha256:718827e4228661d81515f2f29a480e2ad425576c06302a08423d24bb8a5fc11a

Observation 4bfc0516-aa30-4361-a396-1949ed1d2ea3 · outbound

This paper cites Large Language Models are Inconsistent and Biased Evaluators.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators Large Language Models are Inconsistent and Biased Evaluators

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:38.747831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:38.747831Z digest=sha256:81bad35f2fd268109252a7452f5e414cd87f0eb74fcdf422284419fd669f82de

Observation 060f2fa4-2005-40f4-aea7-34173ac8a66c · outbound

This paper cites Improving alignment of dialogue agents via targeted human judgements.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators Improving alignment of dialogue agents via targeted human judgements

Reference 587

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:38.057258Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:38.057258Z digest=sha256:dd5469bd03a821de5bc8773c6cd7cca699a8a028076d97015a6382c8f43d4def

Observation 6fc7cf6a-5be3-4c73-bc4a-5c94bc4c87aa · outbound

This paper cites doi: 10.18653/v1/2021.acl-long.131.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators doi: 10.18653/v1/2021.acl-long.131

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:37.878561Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:37.878561Z digest=sha256:84b403529e8688bb90b0b667320cfa9d972698c3b82600a83a88be8539eca680

Observation 9e8f6fb0-8370-4b2a-b4ff-205c3b3d09b2 · outbound

This paper cites Deep reinforcement learning from human preferences.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators Deep reinforcement learning from human preferences

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:37.624963Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:37.624963Z digest=sha256:4433afefdef45c2e6930768474d1027845a36378045e9c3b2c91d8f91834ffad

Observation 9ce8b10e-f73f-45c1-910d-861c1c3f3d20 · outbound

This paper cites Constitutional AI: Harmlessness from AI Feedback.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators Constitutional AI: Harmlessness from AI Feedback

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:37.567343Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:37.567343Z digest=sha256:3ec94a48c0da4a2133898e5c6a468658173d651036d31dfa09e0702ce76a33ef

Observation 5e0d3ac8-0bff-432f-99d9-cf1fd8d3517d · outbound

This paper cites Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier.

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-02T02:01:37.726521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T02:01:37.726521Z digest=sha256:fbebcfbc90bc30f5913f6c03de554aad39ae9b5d1caae5dab9a5c33426ea9860

Pith citing papers

No inbound Pith citation observations are available.