Pith. sign in

Paper Citation Record · LEDGER

CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2407.02408.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2407.02408 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 6 of 6 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 6 of 6 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:21:30.648740Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-10T11:50:21.226308Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation fe48586a-e370-49c1-95e1-1fa269d76ea8 · inbound

BiasFilter: An Inference-Time Debiasing Framework for Large Language Models cites this paper.

BiasFilter: An Inference-Time Debiasing Framework for Large Language Models CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-07T13:21:30.648740Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:21:30.648740Z digest=sha256:66fd27f5eaf2db5dbef5ff5d5921286a20408f8850436b23b23a0924b1b6abe3

Observation f90a1aa3-3dfb-4b9a-8d82-db6904012563 · inbound

Is Your Model Fairly Certain? Uncertainty-Aware Fairness Evaluation for LLMs cites this paper.

Is Your Model Fairly Certain? Uncertainty-Aware Fairness Evaluation for LLMs CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-07T12:44:08.529925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:44:08.529925Z digest=sha256:166968641e3e31b725b8af7d2d08007e266d20f29c54ecfde539c90edbb586fe

Observation 55a85855-b2ce-4594-8d40-04ba76c817d6 · inbound

The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs cites this paper.

The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T10:17:26.720062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:17:26.720062Z digest=sha256:645cabb53a079f08ed008c1794e6ba2674e51c7fcbcc91929a8c073d416a9a20

Observation ff44f5cd-30d7-4cb2-83c9-1110f53c9b92 · inbound

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models cites this paper.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.456321Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.456321Z digest=sha256:4f9129ec9b81bd038cb7aa072ba774ad185974ad779742b3bfe3b17a99c38831

Observation 867dea91-1cb3-47e1-8893-2e205c2d5ced · inbound

MHSafeEval: Role-Aware Interaction-Level Evaluation of Mental Health Safety in Large Language Models cites this paper.

MHSafeEval: Role-Aware Interaction-Level Evaluation of Mental Health Safety in Large Language Models CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-10T11:50:21.228035Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-10T04:44:51.914312Z digest=sha256:6a32e3d08c73beeddb44a4d0fac0810b17bd64a480e25f4ec698d3c8dbb19b89

Observation be90dfcf-eb67-4096-834f-0261c2c3f69d · inbound

QuantiBias: Benchmarking Quantization-Induced Bias in LLMs cites this paper.

QuantiBias: Benchmarking Quantization-Induced Bias in LLMs CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-01T08:38:50.903781Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T08:38:50.903781Z digest=sha256:fbd94f748a84b8375af2a58d26d49f2d47f9c1f960d13a6957ec08120ec70601