Pith. sign in

Paper Citation Record · LEDGER

CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2010.00133.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2010.00133 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 30 of 30 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:53:59.815517Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T17:38:44.469211Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9a077b82-d57f-43c1-ac94-05b8d5ebfae8 · inbound

BBQ: A Hand-Built Bias Benchmark for Question Answering cites this paper.

BBQ: A Hand-Built Bias Benchmark for Question Answering CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 43

Resolution
verified exact
arxiv_id, observed 2026-05-16T19:55:11.531159Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-05-16T19:55:11.431020Z digest=sha256:faa2596bb7a5f2b113153ffc3ba64d3898b7bad98942437e2a2ab9e390c6f8c5

Observation 38d5b2cf-e3c2-4d57-b0fd-c6b791de08f3 · inbound

Ethical and social risks of harm from Language Models cites this paper.

Ethical and social risks of harm from Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 201

Resolution
verified exact
arxiv_id, observed 2026-05-11T18:24:30.394343Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-05-11T18:24:28.835688Z digest=sha256:dc8f787e0317f93671df8c85ca6bf817a5b30385eeda00ad6dbae48a6f18f2c6

Observation 17ce16be-f6a0-4e89-a2cf-9c92e3b0b68e · inbound

OPT: Open Pre-trained Transformer Language Models cites this paper.

OPT: Open Pre-trained Transformer Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 218

Resolution
verified exact
arxiv_id, observed 2026-05-10T20:53:17.745943Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-05-10T20:53:16.720145Z digest=sha256:e6f92075a93090675f525f3db0bc34e85d114416a3268f82e2d6a9f82551e614

Observation 623afe96-ab53-475a-91b2-a99c22756bc2 · inbound

StarCoder: may the source be with you! cites this paper.

StarCoder: may the source be with you! CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 273

Resolution
verified exact
arxiv_id, observed 2026-05-10T23:33:01.075879Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-05-10T23:32:59.517389Z digest=sha256:eda680ca7d1dd62e8527f42ac030296c464e557ad4e517ef320d71e6deb41d1a

Observation a93c8510-cb55-44e1-8637-8e8266c155c7 · inbound

Self-Rewarding Language Models cites this paper.

Self-Rewarding Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 47

Resolution
verified exact
arxiv_id, observed 2026-05-13T12:01:42.380838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-05-13T12:01:42.290502Z digest=sha256:6a61b5eab533439a1cd2d2ccc4061bbc862104ae7bdcb52ad8773ac427e578b9

Observation 37de5903-ad70-4596-8a5c-651a9ff5e267 · inbound

Bias Unveiled: Investigating Social Bias in LLM-Generated Code cites this paper.

Bias Unveiled: Investigating Social Bias in LLM-Generated Code CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-12T19:46:44.591439Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-12T19:46:44.591439Z digest=sha256:d70e865c98098aa9833774a7d408fee3f1b7b0482a7149802f7e54efd599e841

Observation bf0a1e00-ce68-4a96-b888-926f9f26f5e2 · inbound

Evaluating Generative AI Systems is a Social Science Measurement Challenge cites this paper.

Evaluating Generative AI Systems is a Social Science Measurement Challenge CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T19:12:55.190662Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:12:55.190662Z digest=sha256:549954da10b188fe157ef7b2b47f4c6b8a31f4dcb41831f5f8fb276f37789635

Observation 82e6bce3-b21a-4cb4-a86c-a90788acc916 · inbound

Different Bias Under Different Criteria: Assessing Bias in LLMs with a Fact-Based Approach cites this paper.

Different Bias Under Different Criteria: Assessing Bias in LLMs with a Fact-Based Approach CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-12T12:21:33.906347Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:21:33.906347Z digest=sha256:a0b454114edad4c6f5416a518e1172970709b9afae9962d35e7ec5c8d6414ca8

Observation 32f3218f-9978-4e3e-8264-8180b41c03ca · inbound

Improving LLM Group Fairness on Tabular Data via In-Context Learning cites this paper.

Improving LLM Group Fairness on Tabular Data via In-Context Learning CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-11T21:22:43.474864Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T21:22:43.474864Z digest=sha256:3bfa164f6c0f8dfc3895912f06db28b9df905fd03541d0303ffb4e5b2cb27c89

Observation bfe01989-1fb5-41e3-92bb-1df71b2180e0 · inbound

On the effective transfer of knowledge from English to Hindi Wikipedia cites this paper.

On the effective transfer of knowledge from English to Hindi Wikipedia CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-11T20:31:11.781808Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T20:31:11.781808Z digest=sha256:719dfe51936e3905060e47329949590ed6770035b27300dcddfb98f0aeffd4c1

Observation 002cfe78-1e13-4c77-9045-4f4c15bbb648 · inbound

Value Compass Benchmarks: A Platform for Fundamental and Validated Evaluation of LLMs Values cites this paper.

Value Compass Benchmarks: A Platform for Fundamental and Validated Evaluation of LLMs Values CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-10T20:53:59.770377Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T20:53:59.770377Z digest=sha256:a0c42b2471ab414212e0a0b8a62fa779cb2ad43c80cfe68aaa6f68b36525876c

Observation b7331477-7101-45ee-86ef-810cad7e773c · inbound

The Generative AI Ethics Playbook cites this paper.

The Generative AI Ethics Playbook CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 95

Resolution
unresolved
no resolver link, observed 2026-08-11T13:15:10.768970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T13:15:10.768970Z digest=sha256:81dda6b3b69167e70a2d6cc8d23e5c0cbe890879ea337ac6cc37e766e0ed85c2

Observation 33cef1dc-3ac0-4f89-9cb2-24d67e81fea5 · inbound

Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training cites this paper.

Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-10T17:58:50.514894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T17:58:50.514894Z digest=sha256:401e718d06e903c54da2d51ea27c5c2c7924d0a772a06a2a7942c988d08138dc

Observation 9650fbdc-45db-4b52-91b3-d6f33ab9d339 · inbound

The Science of Evaluating Foundation Models cites this paper.

The Science of Evaluating Foundation Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-07T23:35:42.784802Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T23:35:42.784802Z digest=sha256:239d235b062908dc89aba5ce9c0070d548fc32661cfa34075b8dbd7092f0eadf

Observation 8225761b-51d6-4fa0-a9f5-62022ac26cb3 · inbound

FairSteer: Inference Time Debiasing for LLMs with Dynamic Activation Steering cites this paper.

FairSteer: Inference Time Debiasing for LLMs with Dynamic Activation Steering CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-16T11:53:59.815517Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-16T11:53:59.815517Z digest=sha256:16dcc5d08b9510e058466a574ab308989457e655ae8217f1d30271152fc28baa

Observation 988a91ca-1a30-49ff-82b8-52db2890ca66 · inbound

Improving LLM Outputs Against Jailbreak Attacks with Expert Model Integration cites this paper.

Improving LLM Outputs Against Jailbreak Attacks with Expert Model Integration CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-15T20:36:57.226304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:36:57.226304Z digest=sha256:b166548f87fa283af824a93a59399cd714563db83900ada3f76dba4ef711991e

Observation debc0755-9045-45b1-9b60-0bd2280fead5 · inbound

Relative Bias: A Comparative Framework for Quantifying Bias in LLMs cites this paper.

Relative Bias: A Comparative Framework for Quantifying Bias in LLMs CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T15:12:22.712392Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:12:22.712392Z digest=sha256:80c9014f2fa7a28e464089e45162f5cabf1a24ed55fa797e74bc24293b86398a

Observation d944497f-7a5c-4241-b556-6f5bc7a114c2 · inbound

Fairness Dynamics During Training cites this paper.

Fairness Dynamics During Training CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T11:39:52.400219Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:39:52.400219Z digest=sha256:f37e9f37108bda92b7446f5efb83c0ede59443314ca2a774e67a51a4500d9bd8

Observation 805eee57-73d7-44a2-873d-e2ec3c41b2cd · inbound

Adaptive Task Vectors for Large Language Models cites this paper.

Adaptive Task Vectors for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T11:13:02.006492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:13:02.006492Z digest=sha256:4146ea8acd53dfde26496b42b2cbc72db1312f1d1d241e53b19ccfb233261fa1

Observation 956799bb-5b48-4886-a37a-afef76e8b8bd · inbound

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models cites this paper.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.107028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.107028Z digest=sha256:617d37ebf2b9f8b4fd972c0719cfd70e960ca92f4fc9ea3af4b50b246b5a3750

Observation 58c20924-ff9c-45c0-9830-1ccea725e76b · inbound

Investigating Intersectional Bias in Large Language Models using Confidence Disparities in Coreference Resolution cites this paper.

Investigating Intersectional Bias in Large Language Models using Confidence Disparities in Coreference Resolution CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-05T22:21:05.877970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T22:21:05.877970Z digest=sha256:7f89fe14ba8f13d08230f0bc4ba3f087c73693f2ed97b597b965e6b03d80f465

Observation 3981cd43-c751-4627-810a-b9e4ba610def · inbound

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models cites this paper.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.548322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.548322Z digest=sha256:1b54771b4e6360e1c46702540c5540924c5d079b4af4566ef0ac3488df8622a5

Observation b82a6b6e-1404-4b73-9f76-abb97ecb214a · inbound

When Tables Go Crazy: Evaluating Multimodal Models on French Financial Documents cites this paper.

When Tables Go Crazy: Evaluating Multimodal Models on French Financial Documents CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T01:12:32.176313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T01:12:32.176313Z digest=sha256:4445a0ded88a3a80516fb2a0343ad8cad214ac9d20731243ef97f999068ad08f

Observation 3c42b4ce-a9d9-4f74-810d-221cf1e7e337 · inbound

Social Bias in LLM-Generated Code: Benchmark and Mitigation cites this paper.

Social Bias in LLM-Generated Code: Benchmark and Mitigation CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 146

Resolution
verified exact
arxiv_id, observed 2026-05-11T15:36:08.686178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-05-09T19:34:51.433422Z digest=sha256:c243ae197249e177c0937b020949e4d74692668bfc7826b1c3b20ca31df45e0b

Observation adf7ac43-6339-4af9-9a3a-c029af57c42a · inbound

Navigating the Sea of LLM Evaluation: Investigating Bias in Toxicity Benchmarks cites this paper.

Navigating the Sea of LLM Evaluation: Investigating Bias in Toxicity Benchmarks CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-12T05:31:23.870735Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-12T05:28:45.453455Z digest=sha256:2294994747dc317d42045135fde57a40e90b4554e939364759ccfcb87d4ec48c

Observation 088dc25c-51b0-4bf0-bf5c-bf8b7116fbbe · inbound

SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks cites this paper.

SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 38

Resolution
verified exact
arxiv_id, observed 2026-06-29T22:54:00.973683Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-06-29T22:50:48.263600Z digest=sha256:e76aac9cab5bc801f9a13a7b6a726fb4457c3f861452e5950f183892126b4366

Observation 979da584-358f-44a4-a9da-9f842a0443b5 · inbound

KARMA: Karma-Aligned Reward Model Adaptation cites this paper.

KARMA: Karma-Aligned Reward Model Adaptation CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-06-29T17:53:46.866135Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-06-29T17:52:06.830441Z digest=sha256:813cede2700e54bc26948471d5e0182e4ad7982507ed2b6518a112cec766e439

Observation 254081b9-522e-4c6c-9f52-853f3a8e261b · inbound

On The Effectiveness-Fluency Trade-Off In LLM Conditioning: A Systematic Study cites this paper.

On The Effectiveness-Fluency Trade-Off In LLM Conditioning: A Systematic Study CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 84

Resolution
verified exact
arxiv_id, observed 2026-07-03T11:08:03.493479Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-06-27T09:40:48.736006Z digest=sha256:aa1e88deab412d3a39e760074b57ad09661c182c2db37a8f6105b6c32e525461

Observation 29904cd7-ad28-4077-9d5e-36ba742a7f6d · inbound

AgentFairBench: Do LLM Agents Discriminate When They Act? cites this paper.

AgentFairBench: Do LLM Agents Discriminate When They Act? CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-07-03T17:38:44.470755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-06-27T03:53:38.554457Z digest=sha256:93726fa78fe14ee6f5805163d5c3045f4d06ab334176c85cea2c3999573a0317

Observation da97eac8-1fb3-4ae9-8c6b-0d23d3ed6c0e · inbound

How LLM Task-Adaptation Reshapes Alignment: A Multi-dimensional Study of Behavioral and Representational Drift cites this paper.

How LLM Task-Adaptation Reshapes Alignment: A Multi-dimensional Study of Behavioral and Representational Drift CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T07:44:10.447865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:44:10.447865Z digest=sha256:af5d7f6e9b70e117fbda36de3ce09309f99996bead019253a2d381a48b6e11b3