Pith. sign in

Paper Citation Record · LEDGER

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models

As of 7 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2507.02088.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.02088 v2

Coverage vector

measured 53 of 53 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T20:43:53.885759Z

measured 54 of 54 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-04T11:21:56.069608Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

53 of 53 outbound references displayed

  • verified exact2
  • verified fuzzy1
  • unresolved50
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 70abc207-a1eb-458a-8883-cd69d079d4f5 · outbound

This paper cites online" 'onlinestring :=.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models online" 'onlinestring :=

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.123150Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.123150Z digest=sha256:61cd6089e2029905040d85063657cf55405277b054afbefe2644c73e65535c15

Observation 11fc4adf-2604-49d5-9d04-3ac95f35fba7 · outbound

This paper cites write newline.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models write newline

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.226291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.226291Z digest=sha256:ec76dc36d6d88f13fc91de44e4979edb49f74d0692baf1f4ad285587edb9be0d

Observation b37ad127-5536-4c43-a507-75a2e287896c · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.783403Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.315950Z digest=sha256:969ad430bbd4527c141c8a4e31b7e4176fa07199cf93bf89218c8ba88ead061c

Observation 140c1b4a-2550-4dd6-9fcc-5f6760e6fdd9 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.633355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.425837Z digest=sha256:975dff7ae35c3a8df1a54950a261dc460c039f851cdabfa0042bf3fd89e60512

Observation 579d1fd5-ec8d-41fb-ba9f-0ca66bfbdd6b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.451103Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.527301Z digest=sha256:e09283c680f558bcea4474f9ff3357d0ba987ad6fc5d301c7d161a2151261ced

Observation c00e381d-2a85-450b-abe4-4ce14f24f5e6 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.259950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.639647Z digest=sha256:4a47aa7920e4961f77f0bab274396613d943ebf534a63446ffec775bcf166e6d

Observation c74d4ac1-3d19-4634-b0ba-f2bf0f9e0a96 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.752463Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.752463Z digest=sha256:92648f3f7be15a581c5334baec6794bd6fbe21c40e781ff583664b43647bcbf6

Observation 5857c4b6-59ff-4de3-9e51-24ceca7200f1 · outbound

This paper cites InternLM2 Technical Report.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models InternLM2 Technical Report

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.853394Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.853394Z digest=sha256:b36b86f691bf160accbfdc23e22dfdceb6eefe83efa40a28d5477209a0dc8adc

Observation 19d5d1f3-28f0-48ef-9d4e-5c1800b785ee · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.938219Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.938219Z digest=sha256:f4324db8c242ed9133eca8631fbf005d796410d0d7d2f1e6f7d9c4b664805f20

Observation 50fd2ee8-154e-4584-9183-5a498eb5753b · outbound

This paper cites WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.098492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.098492Z digest=sha256:c44c5eb31d3021bd8feba80c3fbbf91b1e9751b332c0927e5c04e920953dd4cb

Observation 0a67863e-e0d6-411c-b7e0-bc8d4ec444bc · outbound

This paper cites ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.227498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.227498Z digest=sha256:8bd0c3aaee877b24ec797ad0439677eab372ae5f13a9e38de87f61e8f3df3cc4

Observation 711881eb-41c9-4394-8e25-1bb9cf8f1e5e · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.084220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.433474Z digest=sha256:778ebb4a6cb58ed3cef0523d9023fc7e0d1415f98d70ace544db74cb51b7fa76

Observation eea9c54a-c79d-48d7-98e3-56ffa50cceb0 · outbound

This paper cites RuBia: A Russian Language Bias Detection Dataset.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models RuBia: A Russian Language Bias Detection Dataset

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-08-06T20:43:54.557581Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.584453Z digest=sha256:719960f6986205b3b8f7a4d090a1ee2fd14b1eb3e55e5563184d9ed0ac23a2e3

Observation b7655efe-803e-4065-804a-cc4b883dbd81 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.929909Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.740044Z digest=sha256:67999658831c6dc04f342e100cc36cec6c963874bd77ba2c73122289e7eaf2c8

Observation 60f3b0c1-5e71-4e43-a9aa-8466e799799e · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.823334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.823334Z digest=sha256:cebc8c25c5726fbc6c4d5d9c3eb41c298efb1747134ad34b692e9031cae78f95

Observation 4d597594-5ac7-44a8-87f2-1a412b48ff08 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.722708Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.920491Z digest=sha256:af49c8ebafc81eb3bdacaa1332742487277a8ca0c6271876e2ea331df6c1457c

Observation 21b1fcfc-3760-4be6-9caa-dbbbb477bad0 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.520559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.026171Z digest=sha256:33d2e1efb663215a5e78ce7a6908b185706c855ed654328127a516f98d47a4c3

Observation 414bec75-ebbf-4aea-a2d0-dc4def6fd23c · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.401960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.129634Z digest=sha256:5c2a4fa855961344785b14d3ccbd814c05b1bf8f4867b280d93dd77774a15af6

Observation b6ca40df-5202-4e74-9d4c-d7ccea68f00e · outbound

This paper cites CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.221195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.221195Z digest=sha256:608b5e455fe2b489f67a6d7d7882e2152749f1ba7a56597c1045bb6fac63eb7a

Observation a11af52c-2bf3-4bf4-be6b-59a079bfd91a · outbound

This paper cites Mistral 7B.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Mistral 7B

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.288121Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.288121Z digest=sha256:7b5eb2f969847f795a919420d70a1eeee082c307869037e3fb9fe7acbfa0874f

Observation c5a13ecc-504a-4c5f-b138-7ef275f6a922 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.259778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.461104Z digest=sha256:1cec19da87aae2cdfd8a990465504bab433abce11382c1cc7ebba4587d127399

Observation c98fa4de-2435-4b8c-82be-5c4916487221 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.116278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.569770Z digest=sha256:02814e1a537576efb4bee3e64534f461b5be6bab2d484a6e2450636d4eb41e8c

Observation 5ad80883-d926-42b7-9fb2-81e0fe2de551 · outbound

This paper cites Adaptation of Deep Bidirectional Multilingual Transformers for Russian Language.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Adaptation of Deep Bidirectional Multilingual Transformers for Russian Language

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.655254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.655254Z digest=sha256:2b63b8521b4b58c51b2f0505df930048ad1cab628607dbbfc5f18fad95519e9f

Observation 27243f0e-bde1-493f-bec9-c19cc552c9b8 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.959436Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.735395Z digest=sha256:858e57bca17810c87ae1f08fa9793a16e67e68419df52e4fac7a1fa14b66f14a

Observation 339dddbf-8122-4751-8ac9-b2e0d8799660 · outbound

This paper cites Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.814181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.814181Z digest=sha256:9102e2f27273e20140c5482718f11cde50049d3dc7e07beefe0acf7ccacdad39

Observation 67dae05b-d3a9-4b9a-872b-4e1f2c8e8f8b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.791668Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.877921Z digest=sha256:a6bed62cb0186a36d0246adf4252b6b963feda9128158441837092b76c3ecfe8

Observation 13fa5e33-fe40-4336-a0d7-54fcc4c693e7 · outbound

This paper cites DeepSeek-V3 Technical Report.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models DeepSeek-V3 Technical Report

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.950417Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.950417Z digest=sha256:e778581501cdaeebf1999900b0d4068440c485d6644c2b2e428765a447793c83

Observation 15aaa887-d913-426b-b5e8-10cec00af024 · outbound

This paper cites StereoSet: Measuring stereotypical bias in pretrained language models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models StereoSet: Measuring stereotypical bias in pretrained language models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.015253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.015253Z digest=sha256:136c8da9c13d263f0bbcb08f1ffedeba61721d688f7a99584334bdc26bef5319

Observation 956799bb-5b48-4886-a37a-afef76e8b8bd · outbound

This paper cites CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.107028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.107028Z digest=sha256:08598ba8a8c0915d3b077d7369a5c9b481e2ecd7153fab453fc250dd3064398c

Observation 822d56e8-7382-462d-8647-94fbd17a5cfe · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.668459Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.191096Z digest=sha256:459cec850bb2d48dd3f4724a0272fdcc2e3237dceed7ab6e3203c941d0ecd0c9

Observation 95106ad7-492a-481e-be92-a869e79e368f · outbound

This paper cites BBQ: A Hand-Built Bias Benchmark for Question Answering.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models BBQ: A Hand-Built Bias Benchmark for Question Answering

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.282476Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.282476Z digest=sha256:85ebe7d12f4c42768c8e6897a6d48f0ca422ef2458138df455defb931d9230f6

Observation 5ed5d67c-23b9-472e-99fb-0df4755d1218 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.571998Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.373254Z digest=sha256:c7c8fb545eac610388c035fcaf04978c0ae3ea34ba24747c988866e0c4fee051

Observation b79a0352-d996-4431-84c1-4747ed27f94c · outbound

This paper cites Gender Bias in Coreference Resolution.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Gender Bias in Coreference Resolution

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.465611Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.465611Z digest=sha256:32efc10a13601b940e178027a75d504880d0416a3a51b55ad92a19f6408466a3

Observation 495eeaea-a1db-40cf-9318-d9bb0771aa49 · outbound

This paper cites IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian Context.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian Context

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.544990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.544990Z digest=sha256:296856d33a7f1ddf296b313cf81497d94e7b00a3d9fe7f4b694a35dcc2ff848f

Observation 660fae65-61ce-4433-ab83-96b4d6077ec1 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.417463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.646131Z digest=sha256:d3eb26c58814e9329042ed4531333bad9c915c12ece7a7873f036db29a2b8b4d

Observation 188f3a01-cd5b-4912-8827-6a5a68477e9d · outbound

This paper cites FineDeb: A Debiasing Framework for Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models FineDeb: A Debiasing Framework for Language Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.727546Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.727546Z digest=sha256:838277e332000607f8806b26fd84be5326acf623a43a257b6965eae85f262419

Observation 33389b95-9cd5-4c41-a542-d58029060d49 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 37

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.274110Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.818717Z digest=sha256:f0f1aa4036b785f3eee07b36e4aa099e8a3497a2822c67cdd069dd6815cc8a2e

Observation c50c5c8d-83b8-4e69-9b03-7946e5c9643b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.160238Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.864756Z digest=sha256:2dcd02b0f5920b3f3372a6584d34ae97c90a04e0a3c9a866f889ae21021df34b

Observation d8eafa20-d2bf-47d2-b74a-483033cb4afa · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.004800Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.940549Z digest=sha256:4de9e575fe51eaed5d8902ef406f9a92bb3b1bf8c526fd6437dc513701d08bf1

Observation 5072e452-4ab7-462d-91a6-0ed79477adcb · outbound

This paper cites Fewer Errors, but More Stereotypes? The Effect of Model Size on Gender Bias.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Fewer Errors, but More Stereotypes? The Effect of Model Size on Gender Bias

Reference 40

Resolution
verified exact
local_arxiv, observed 2026-08-06T20:43:54.221961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.025679Z digest=sha256:625a982f3de96d629f925d6b330dbcc2bc15b3ac8cdd127d937222e9aa15d995

Observation 8477accb-86c4-4061-846b-7bb701530001 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 41

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:54.870070Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.083634Z digest=sha256:7ebef3e1663a02b3d6f6635807ce43875f3580d9569bf319f4ad94e4c253f455

Observation c61b1df8-725e-4e2f-aba9-29824afb4487 · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.162694Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.162694Z digest=sha256:54619d4dd3f424d33a00fe690c5cde33d9fb1434dbc58422e9295190d0cdd33d

Observation 4a1e8297-fdc4-4be5-ac49-e0b56ca7201d · outbound

This paper cites Nationality Bias in Text Generation.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Nationality Bias in Text Generation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.240019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.240019Z digest=sha256:4b9660376f4cbbfde2d2f2472ef5dd49588d1153540f5288f2f37ee0e7dc86ba

Observation 70271fd1-06bf-41e7-8540-248463cab8de · outbound

This paper cites White Men Lead, Black Women Help? Benchmarking and Mitigating Language Agency Social Biases in LLMs.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models White Men Lead, Black Women Help? Benchmarking and Mitigating Language Agency Social Biases in LLMs

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.300456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.300456Z digest=sha256:7aab116168bea222dfbb601d8523bd5eee12b98b92b0375eed84f659477d9da8

Observation 877703ff-2ac7-4b28-be53-30272425dd63 · outbound

This paper cites "Kelly is a Warm Person, Joseph is a Role Model": Gender Biases in LLM-Generated Reference Letters.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models "Kelly is a Warm Person, Joseph is a Role Model": Gender Biases in LLM-Generated Reference Letters

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.367103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.367103Z digest=sha256:375a570dfe9683e8a45ccc917798ce78eea1b20cea0f6386e4f8601ee5c2f5bd

Observation ff44f5cd-30d7-4cb2-83c9-1110f53c9b92 · outbound

This paper cites CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.456321Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.456321Z digest=sha256:4f9129ec9b81bd038cb7aa072ba774ad185974ad779742b3bfe3b17a99c38831

Observation 1c487782-603d-477f-9d56-0034ad23110a · outbound

This paper cites Ethical and social risks of harm from Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Ethical and social risks of harm from Language Models

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.513331Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.513331Z digest=sha256:8f50d1353311c369219271466f3f4477d8da91f96c56911d273bddac414582f4

Observation 7ff40210-2587-489d-a6db-d2b757d2e7f4 · outbound

This paper cites JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.588373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.588373Z digest=sha256:79fae95097b425515caeed9c3d5543a753f771b9cd92f2cf125a28d958eed391

Observation 9137be06-1e66-4d95-857b-bebef2820f60 · outbound

This paper cites Baichuan 2: Open Large-scale Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Baichuan 2: Open Large-scale Language Models

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.690428Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.690428Z digest=sha256:ff7e4ccf024380ccdee65e7fb30b5d528aaa6f5dfbede7fd69f5f13bdc5ea388

Observation f7a8b70f-23c1-4cb3-9ad5-aeab1bcf4259 · outbound

This paper cites CHBias: Bias Evaluation and Mitigation of Chinese Conversational Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CHBias: Bias Evaluation and Mitigation of Chinese Conversational Language Models

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.769413Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.769413Z digest=sha256:8e6bb9c8a9ec56972a162ab6ba83a6e54cfdf0476699a43b9cec1d416f52d9a1

Observation 221ed02f-c165-45ca-8ca4-c281abc1fa5f · outbound

This paper cites Gender Bias in Coreference Resolution: Evaluation and Debiasing Methods.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Gender Bias in Coreference Resolution: Evaluation and Debiasing Methods

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.846796Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.846796Z digest=sha256:5c3daff4209dd237bb889d02b1ba0511fb835442c2c1e1329b5860ca853957bf

Observation 163053ac-8f4e-47d8-a93c-afba362ab467 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.858313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.858313Z digest=sha256:52f594c8f691c7d8a6fb9ec4d672aaffdaebdfe51f65b1075fa9c902d6e96ddd

Observation 7cbd701e-4012-4d63-8239-d3eb8b1d673c · outbound

This paper cites Markov, Vladislav Mikhailov, and Alena Fenogenova.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Markov, Vladislav Mikhailov, and Alena Fenogenova

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:43:54.739474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.885759Z digest=sha256:119f024f8fb7eaa76bc12349488413043a37cc313490aa28bc08c9a9c402f8cc

Pith citing papers

Observation dcb47e15-903c-4418-9f64-2f1fc147d8d6 · inbound

Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages cites this paper.

Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-04T11:21:56.069608Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T11:21:56.069608Z digest=sha256:e421a71489b4f33c78a3fff460635afedf07307854a40e9064f7236671de1a72